多智能体推理能力」共找到 7019 篇相关文章

算法论文8

综述 | Agentic RL for LLM的最新进展与未来挑战,idea满满

该综述对新兴的Agentic RL进行系统性总结与展望,介绍其与传统LLM - RL区别,从核心能力和任务视角阐述其应用,梳理支撑系统,指出核心挑战与未来方向,展示通向通用AI的希望之路。

深度学习自然语言处理
产品应用8

在WAIC现场,全球首个拥有「原生记忆力」的大模型亮相,但不是Transformer

在WAIC上,RockAI推出基于非Transformer架构Yan 2.0 Preview的多模态大模型,有原生记忆能力。它在性能指标上优势明显,其记忆机制接近生物方式,团队秉持理念推动离线智能,获硬件厂商关注。

机器之心
算法论文8

MeanFlow再下一城,北大提出机器人学习新范式MP1,实现速度与成功率双SOTA

北大研究团队提出机器人学习新范式MP1,将MeanFlow引入机器人学习,实现毫秒级推理速度。还引入分散损失提升少样本泛化能力,在仿真和真机测试中,实现速度与成功率双SOTA。

机器之心
算法论文8

如何将LLM的"思考习惯"迁移到视觉领域?

传统多模态模型处理复杂视觉推理能力不足,OVR团队以Qwen2.5 - VL - 7B为基础构建开源强化学习框架,成果模型OVR在12个基准测试刷新记录,揭示认知行为跨模态迁移三条黄金定律。

深度学习自然语言处理
算法论文8

理解帮助生成?RecA自监督训练让统一多模态模型直升SOTA

统一多模态模型在视觉理解和生成能力上不平衡,常理解强但生成弱。本文提出重建对齐(RecA)自监督后训练方法,不改动架构,用未标注图像训练,在多模型实验中提升性能,部分达SOTA。

机器之心
新闻资讯7

沃顿教授警告:老板用AI正偷偷赚钱,而你还在审它做的17份PPT?

AI跨越关键门槛能完成有经济价值的工作,但也可能产生大量无用内容。OpenAI新测试显示大模型进步快,虽暂难取代人类工作,但智能体工作续航能力大增,人类对其使用方式决定未来。

新智元
产品应用7

实测美团 LongCat:快到极致,但是别说追平 DeepSeek

AI科技评论实测美团LongCat-Flash-Chat,它是中量级对话模型,主打“快”,几乎零延迟。但在推理、抗污染能力等测试中,相比DeepSeek-V3.1,逻辑链条松散,缺乏清晰判断。速度与逻辑哪个更重要,值得思考。

AI科技评论
新闻资讯7

OpenAI波兰双雄:GPT不是偶然!再忆奥特曼被逐当天实况

OpenAI宫变时,Jakub Pachocki与Szymon Sidor力助奥特曼翻盘。他们高中相识,因AlphaGo加入OpenAI。ChatGPT并非偶然,是团队深耕成果。二人推动推理模型发展,强调AGI发展中对齐问题重要,要兼顾能力与安全。

新智元
8

o1核心贡献者离职后首发声:AI是史上最强杠杆,超越人力、资本和代码

刚被曝加入Meta的前OpenAI核心研究员Hyung Won Chung,分享对AI未来的思考。他认为AI是最强大杠杆,能成个人能力倍增器,智能体开启无需许可的复合杠杆,还能推动人类科学进步。

量子位
产品应用8

Lovart第一时间上线Image 2:每个人真的可以瞬间拥有一个设计部了

Lovart上线Image 2,有去AI味的写实感、强大文字生成与泛化推理能力,完爆Nano Banana 2。它结合独家工作流,带来设计体验飞升,还给出五个使用场景案例,并对比了与Claude design的差异。

AI寒武纪