「长任务智能体」共找到 5336 篇相关文章
监督学习未死,一题训练五小时起飞!华人学者新方法20倍训练效率释放大模型推理能力
大模型推理能力研究中,RL训练资源成本高、不稳定,传统SFT低数据量易过拟合。加拿大滑铁卢大学华人团队提出One - Shot CFT方法,用一题多解多点评训练,仅需约5个GPU小时,效果好、稳定性强。
年仅24岁、博士退学、项目平平,却签下2.5亿美元天价Offer?Meta的这波操作,全网看懵了
Meta为24岁AI研究员Matt Deitke开出2.5亿美元薪酬包,震惊业界。他学术履历普通,项目也遭质疑独特性。但Meta重金抢人,反映AI人才争夺激烈,也改变了年轻工程师命运。
告别单Agent,AI Agent进入团战时代!
上周CAMEL - AI开源Eigent,号称“全球首个桌面端多智能体生产力团队”,后脚Manus上线功能相似的“Wide Research”。本文分享Eigent内核,介绍其特色、与Manus对比,还深挖技术架构、MCP及容错机制。
开出10亿美元天价,小扎挖人Mira创业公司惨遭拒:俺们不差钱
七月,Meta 超级智能实验室挖人不停。扎克伯格瞄向 Mira Murati 创立的 Thinking Machines Lab,开出超 10 亿美元报价却无人接受。同时,Meta 还挖走苹果第四位核心成员,苹果小幅提薪仍难留人。
共青年之智,铸AGI未来|2025 WAIC云帆奖得主名单揭晓
2025年7月27日,2025 WAIC云帆奖颁奖典礼在上海举行,公布了「璀璨明星」「明日之星」及提名奖得主名单。活动由多机构联合主办,汇聚产学研资力量,众多知名人士出席颁奖。文章还介绍了各位得主的成就。
EvaLearn:AI下半场的全新评测范式!
OpenAI研究员指出传统基准测试难衡量AI实际效用。复旦大学与字节跳动等团队提出全新评测范式EvaLearn,以连续问题求解为核心,构建问题并设评分标准,对九个前沿大模型研究有诸多发现。
不拼参数,拼认知:工业AI的边界与深水区 | 甲子光年
如今AI渗透工业各环节,形成“大小协同”格局,但面临场景复杂、数据孤岛等挑战。西门子凭借深厚积累构建工业体系,其Industrial Copilot等产品落地中国,还自研基础模型突破瓶颈,围绕‘AI for Real’理念布局。
当博世XC决定像创业公司一样去战斗
本文讲述博世智能驾控事业部(XC)变革故事。2022 年交付遇阻,李金龙小范围改革;2023 年订单减少,吴永桥上任展开变革。博世加大中国业务变革,像创业公司战斗,订单增长,未来左右开弓应对竞争。
推理速度飙升5倍,苹果提出全新Multi-Token生成框架!
自回归语言模型逐词生成文本拖慢推理速度、限制并行能力。Apple提出全新框架,挖掘其对未来词元“先验知识”,通过多项技术并行预测多词元,微调预训练模型可显著提速且不损输出质量。
ICML 2025 | 大模型能在信息不完备的情况下问出正确的问题吗?
当前大语言模型推理研究多聚焦被动推理,主动推理研究少,制约其在现实场景应用。为此提出 AR - Bench 基准评估大模型主动推理能力,实验显示大模型主动推理能力严重不足,并指出后续拓展方向。