任务性能」共找到 3542 篇相关文章

算法论文8

突破Agent长程推理效率瓶颈!MIT&新加坡国立联合推出强化学习新训练方法

AI Agent处理复杂任务时显存、算力问题凸显,MIT和新加坡国立大学联合提出MEM1框架。它基于强化学习,让智能体学会管理记忆,实现近似常量级显存开销,在多方面表现超越大模型。

量子位
开源动态7

最强MCP开源:Windows-MCP

Windows MCP 是轻量级开源项目,能让 AI Agents 与 Windows 无缝集成。它弥合大语言模型与 Windows 差距,可执行文件导航等任务,有诸多关键特性,还给出在 Gemini CLI 和 Claude Desktop 的配置方法。

PaperAgent
算法论文8

只用2700万参数,这个推理模型超越了DeepSeek和Claude

Sapient Intelligence研究者受大脑机制启发提出分层推理模型(HRM),该模型仅2700万参数、1000个训练样本,就在复杂推理任务上超越DeepSeek和Claude等模型,还引入近似梯度等创新设计。

机器之心
产品应用7

领域驱动的 RAG:基于分布式所有权构建精准的企业知识系统

银行技术供应商为解决文档和专业知识获取难题,探索用 RAG 技术,严格将 AI 作咨询工具。重新分配 RAG 实施所有权,采用元数据方法,探索伸缩性解决办法,构建完整应用并评估性能,结果令人振奋。

InfoQ
开源动态7

微软开源多智能体自定义自动化工作流系统,加速搭建基于AI的自动化系统

微软开源多智能体自定义自动化工作流系统,可助企业用AI智能体实现复杂组织任务自动化。该方案整合多项Azure服务构建管道,有聚焦核心价值等功能,还给出部署指南与成本估算。

GitHubStore
产品应用7

已量产交付!芯桥半导体全栈国产GPU助推智算自主化

芯桥(北京)半导体成立于2025年3月,掌握核心自主知识产权,旗下Sinexus X200及Sinexus S200已量产,产品在多算力集群点亮。X200性能强、价格优,芯桥还提供全栈式解决方案。

芯师爷
算法论文8

强化学习没作用?人大DelTA精准识别关键token,推理正确率大幅上升

人大高瓴研究团队提出DelTA算法,不依赖经验为强化学习目标中每个token算最优权重。实验显示它适配主流强化框架,在多任务上提升base模型效果,还能让训练更稳定。

量子位
算法论文8

给 Agent Skills 装上眼睛:MMSkills 用多模态技能包教会智能体看状态、做决策

上海交通大学和小红书团队推出面向通用视觉 Agent 的多模态技能框架 MMSkills,将可复用技能扩展为多模态程序性知识,通过 branch loading 调用视觉证据,在 GUI 与游戏任务评测中表现出色。

深度学习自然语言处理
算法论文8

马斯克惊叹!DeepSeek和Kimi先后出手,捅破了Transformer的「潜规则」!

文章介绍了DeepSeek和Kimi在残差连接上的突破。DeepSeek让连接权重可学习,用数学约束保证稳定性;Kimi将注意力机制用于层间连接,解决了更根本的问题,性能提升显著。

花叔
产品应用7

养虾时代终结?免部署、7×24小时在线、自进化的“赛博骡子”来了!

全球首个自进化个人AI——MuleRun(骡子快跑)正式发布,免部署、7×24小时在线、可自主进化。它适配个体需求、实现群体智慧共享,能完成多类任务,还保障安全、提供售后。

量子位