算法论文8
微软&北大提出自适应推理模型
PaperAgent
AI 摘要
微软&北大:提出大型混合推理模型LHRMs,可自适应决定是否思考。经两阶段训练,用新指标评估,实验显示其推理和通用能力超现有模型,还提升了效率。
阅读原文 · PaperAgent
拒绝不必要Think:微软&北大提出第一种自适应大型混合推理模型
大型推理模型冗长思考开销大,微软研究院和北大提出大型混合推理模型(LHRMs),它能依查询上下文决定是否思考。介绍了两阶段训练流程、评估指标,实验显示其超越现有模型且效率高。

关注公众号
扫码关注
第一时间收到每日精选
相关文章
新闻资讯7
微软发布Agent Framework相关组件
2026年4月2日微软发布Agent Framework 1.0版本,Build 2026大会上相关组件进入稳定发布阶段,后Harness和Foundry Hosted Agents正式发布,解决构建和运行时问题,还介绍其功能、优势等。
InfoQ
开源动态8
微软开源 Skill 神器,让 AI 学会干活
近期微软开源桌面应用 `Skill Recorder`,1个多月揽3K star。它能录屏幕操作,借助 GitHub Copilot CLI 生成可复用 Skill 或 Automation,与 RPA 思路不同,有泛化能力,可按命令快速安装。
开源先锋
新闻资讯7
微软叫停Tokenmaxxing,严控AI使用成本
从今年7月起,微软为各业务部门设「AI Token预算目标」,将GPT - 5.6设为内部默认模型。此前Tokenmaxxing风靡硅谷,如今大厂纷纷收紧AI使用,微软是最后跟进者之一。
量子位
算法论文8
北大论文:让 Skill 进化,Agent 变强
北京大学连发两篇论文,给出让 Agent 变强的答案:让 Skill 自己进化。`SESA` 针对工具增强的搜索问答,用四个阶段闭环使任务生成和技能记忆一起进化;`VeriSkill` 把验证器废信号变成可信更新,二者场景不同但核心一致。
PaperAgent