「多模型推理」共找到 10037 篇相关文章
Anthropic智能体大会:Agent也会精神分裂,我们发现了多Agent协作的本质解法。
Anthropic开发者大会聚焦Agent,分享多智能体实战经验。Omni的Blobby出现‘精神分裂’问题,根源是内外层Agent能力认知断裂,修复方案是将工具上提。Anthropic团队则通过协商签订协议解决角色定义不一致问题。
断网可用!首款全双工全模态大模型技术报告发布,附一键安装包
面壁智能等联合发布MiniCPM-o 4.5技术报告,它是业界首个端到端全双工全模态大模型,采用Omni - Flow架构。同步推出在线Demo、API、端侧安装包等,低显存GPU即可运行,性能表现优秀,应用潜力大。
美团新独立APP,点不了菜只能点AI
美团新开源LongCat-Flash-Omni模型,支持多模态,在全模态基准测试达开源SOTA水准,推理快且全模态能力强。实测交互体验丝滑,其迭代逻辑清晰。该模型成功源于架构创新,美团靠软硬件结合实现虚实连接。
北航领衔发布300页代码智能综述:从基础模型到智能体,一次读懂Code LLM全景图
北航领衔联合近30家机构撰写《From Code Foundation Models to Agents and Applications》,系统梳理代码智能领域,串联模型、任务等成完整技术链路,还通过实验等给出实践指南。
GPT-5来了!人人都能免费用,最强大模型只需最傻瓜式使用
全世界等了2年,GPT - 5正式发布,面向所有人免费开放。它在AIME 2025取得优异成绩,编程等方面全面提升,集成多模态和推理能力,还推出多种使用模式和API模型,不过也遭马斯克等质疑。
定位大模型「作弊」神经回路!新研究首次揭示:虚假奖励如何精准激活第18-20层记忆
此前学术界发现大模型用虚假奖励训练也能提升准确率,背后微观机制是黑盒。南科大等团队深度拆解,定位到关键记忆节点,发现‘困惑度悖论’,还能操控记忆,成果对评估、检测和去污染有意义。
硬核拆解大模型,从 DeepSeek-V3 到 Kimi K2 ,一文看懂 LLM 主流架构
本文详细列举 8 个主流大语言模型,硬核拆解架构设计与革新思路,介绍架构演进趋势。如 DeepSeek-V3 的 MLA 与 MoE 技术,OLMo 2 的归一化策略,Gemma 3 的滑动窗口注意力机制等。
取消AI考核、零裁员!股价暴跌82%后,多邻国走出了一条反硅谷之路
多邻国曾是 AI 转型标杆,股价一度暴涨,但近一年暴跌 80%。创始人 Luis von Ahn 表示不裁员,曾将 AI 应用纳入考核又取消,分享员工用 AI 开发课程案例,还谈了 AI 局限、对行业影响及公司应对策略。
谷歌全线开挂!Gemini 3 Deep Think夺多项推理SOTA,Gemini亚洲新团队也官宣了
谷歌的Gemini 3 Deep Think模式正式上线,推理能力显著加强,在ARC - AGI、HLE等多项权威测评中夺魁,仅向Google AI Ultra订阅用户开放。同时,谷歌DeepMind将在新加坡成立新的Gemini研究团队,由95后华人科学家Yi Tay带队。此外,谷歌还推出了Google Workspace Studio。
ACL 2026 综述:从事后解释到内生解释,大模型内生可解释性的前沿进展
大语言模型强大但解释性成问题,过去多事后解释,现更多研究者转向内生可解释性。ACL 2026 接收的综述论文梳理相关代表方法,总结为五类核心设计范式,指出该方向面临挑战但趋势清晰。