「多工具推理」共找到 6815 篇相关文章
告别数据「噪音」,UCSD大模型推理新方法DreamPRM充当「信号放大器」,登顶MathVista测评榜
DreamPRM由加州大学圣地亚哥分校团队开发,在MathVista测评榜夺冠。它通过双层优化框架解决多模态过程奖励模型训练难题,能与多模态大模型集成,提升推理能力,实验效果显著。
2025宝山·智能机器人产业大会暨嘉年华隆重开幕
2025年11月21日,‘2025宝山・智能机器人产业大会暨嘉年华’在智慧湾科创园开幕。领导、院士专家、企业代表齐聚。会上发布行动方案,启动多个平台与中心,完成项目签约与揭牌,还有主旨演讲及多场活动。
智能PPT生成系统
MultiAgentPPT是基于A2A + MCP + ADK的多智能体系统,能流式并发生成高质量PPT。它通过多智能体协作,从大纲生成到内容汇总,提高效率与准确性,还介绍了使用界面、项目结构、快速开始步骤等。
GPT-5超越人类医生!推理能力比专家高出24%,理解力强29%
最新研究显示,GPT - 5在医疗领域处理多模态信息能力出色,在多模态测试中推理和理解得分比GPT - 4o分别提高近30%和36%,比人类医生还高。其能力提升源于端到端多模态架构,但现实应用还需更多实战考验。
AICon 2025 深圳回顾:AI Agent 爆火全场,管理与推理优化成新焦点
2025年8月22 - 23日,AICon全球人工智能开发与应用大会在深圳落幕。70 + 嘉宾、800 + 开发者与企业代表参会。AI Agent成全场焦点,企业管理议题意外走红,展示了AI深入企业核心与管理的行业图景。
突破Agent长程推理效率瓶颈!MIT&新加坡国立联合推出强化学习新训练方法
AI Agent处理复杂任务时显存、算力问题凸显,MIT和新加坡国立大学联合提出MEM1框架。它基于强化学习,让智能体学会管理记忆,实现近似常量级显存开销,在多方面表现超越大模型。
Gemini准确率从21%飙到97%!谷歌只用了这一招:复制粘贴
Google Research研究发现,将输入问题复制粘贴一遍,能让大模型在非推理任务上准确率惊人提升,如Gemini 2.0 Flash - Lite从21.33%升至97.33%,且几乎不影响生成速度,但不适用于推理场景。
JinaVDR: 一个图文混排文档搜索任务的基准集
现有文档检索基准大多只考虑纯文本,难以处理含图表等视觉信息的文档。JinaVDR 应运而生,它是图文混排文档搜索基准集,含多语言、多领域数据,可评估模型在复杂视觉文档的检索性能。
林俊旸离职后首次发声!复盘千问的弯路,指出AI的新路
林俊旸离职阿里千问后发声,反思千问技术路线,认为千问合并两种模式未做好。他指出推理时代已过,未来是智能体时代,智能体思考将成主流,还阐述了其与推理思考区别及面临的挑战。
OpenAI发布MRC超算协议,重塑10万GPU集群通信,AMD等合作推进
OpenAI联合AMD等发布MRC超算协议,它基于RoCE标准,打破传统网络局限,解决超大规模计算集群难题,降低成本与能耗。MRC有多平面网络等特性,已在多超级计算机部署,规范也已公开。