「智能体推理」共找到 5183 篇相关文章
首创Mid-training范式破解RL奥秘,Llama终于追平Qwen!
上海创智学院和上海交通大学研究团队深入探讨不同基础语言模型在强化学习训练中的差异,提出中期训练策略,将 Llama 改造成适配 RL 的推理基础模型,缩小与 Qwen 性能差距,还发布了 MegaMath-Web-Pro-Max 数据集。
浙大开源HugAgentOS:三引擎一体自进化,每步可归因/回放/回滚
过去一年,Agent任务执行能力提升,但不会自主积累与进化。浙大开源的HugAgentOS把Harness拆成三个可自我成长的引擎,设归因和本体两道关卡,解决经验成能力等问题,还覆盖智能体完整链路。
一篇Loop+Harness的自进化Agent最新综述
本文分享清华关于经验时代,已部署的 Agent 如何将交互轨迹转化为持久能力,从自我进化到元进化的论文。介绍了 Harness、技能、记忆、环境等方面,还提及 RL 与持续学习、元进化智能体等内容。
LLM近期重大架构进化一览:从Gemma 4到DeepSeek V4
近期大模型长上下文需求增长,成本问题凸显。Google Gemma 4、Poolside Laguna XS.2、Zyphra ZAYA1 - 8B、DeepSeek V4 等模型各有架构优化,如 Gemma 4 跨层 KV 共享和 PLE,以降低长上下文推理成本。
全球第一,13个SOTA!我们找到了龙虾界掌管GUI的神
明略科技推出自研 GUI-VLA 智能体模型 Mano-P 1.0,不依赖 API 对接与浏览器场景,可操作桌面软件与网页界面。它在 13 个多模态基准榜单达 SOTA,支持本地运行,数据零上云,采用分阶段开源策略。
暴瘦30磅险丧命,61岁硅谷极客用AI重读11页病历,揪出罕见血癌
61岁硅谷极客Steve患罕见血癌,曾被误诊近一年。他构建AI医疗智能体确诊病情,后用AI定制治疗方案,病情好转。他还开发AI医疗平台CureWise,同时指出AI在医疗中有边界,应辅助决策。
CVPR 2026 | 从视觉Token内在变化量出发,实现VLM无损加速1.87倍
随着高分辨率图像与长视频处理需求增长,大型视觉语言模型推理效率成瓶颈。V²Drop从视觉Token内在变化量出发,采用多阶段渐进式剪枝策略,实现无损加速,在图像和视频理解场景表现卓越。
把20亿参数装进胸针?高通补齐了个人AI生态的最后一块拼图
在MWC巴塞罗那展会上,人们渴望专属AI智能体。高通认为AI须进驻微型载体,推出骁龙可穿戴平台至尊版,将AI运算能力延伸到微型设备,其还构建以用户为中心的生态,让私人助理融入生活。
Cursor:AI编程「第三时代」来了
近日,Cursor CEO Michael Truell 称 AI 编程迈入「第三时代」,特征是 Agent 能在少人工干预下完成大规模任务。Cursor 核心转变,内部超 1/3 代码提交由云端智能体创建,团队预计多数开发工作将由其完成。
这可能是,全球最强开源Agent模型,走了一条反Scaling Law的全新范式!
MiroThinker v1.5开源,其30B小模型在Agent benchmark上击败万亿参数的Kimi K2T。它以交互深度为新Scaling维度,训练有严格时间管控,实测表现超Search Agent,“小模型+强交互”或成新方向。