多模型协同」共找到 9806 篇相关文章

算法论文8

条条电路通罗马:大模型可解释性的「唯一机制」可能从一开始就不存在

长期以来,机制可解释性领域默认模型对同一任务的能力对应唯一内部「电路」。但被ICML 2026接收的新论文指出,「唯一电路」可能不存在,同一任务可由个结构不同但能力相当的电路完成。

机器之心
算法论文8

刚刚,智元提出SOP,让VLA模型在真实世界实现可扩展的在线进化

智元具身研究中心提出SOP框架,可让VLA模型在真实世界实现可扩展的在线进化。它是颠覆性的机器人学习新范式,整合在线、分布式和任务机制,构建闭环打破机器人认知时间边界。实验显示其性能优越。

机器之心
产品应用8

刚刚,Qwen3.8-Flash震撼发布,我们看到了Qwen4的骨架

8月大模型厂商上调API价格或收缩免费额度,因推理需求增长跑赢算力供给。阿里发布Qwen3.8-Flash并开源,成绩亮眼且价格低。它是Qwen4架构预演,有四大技术创新,提升了模型效率。

机器之心
算法论文8

模型到底是怎么「思考」的?第一篇系统性综述SAE的文章来了

在大语言模型时代,人们需要“能解释”的LLM。SAE技术崛起,作者团队发布首篇SAE综述,梳理其技术、演化和挑战。介绍了SAE概念、优势,涵盖其技术框架、可解释性分析等方面内容。

机器之心
开源动态8

4K Star的人 Agent 协作平台 Multica!Agent即队友,可像同事一样被指派、被追踪!

当前 Agent 协同缺乏统一管理和经验沉淀,GitHub 开源的 Multica 平台解决了这一问题。它把编码 Agent 变成队友,自动化处理任务,支持 Agent 后端,有种功能特性,提供云服务和自托管两种使用方式。

开源星探
开源动态8

300个AI员工,跑满4000步不崩,Kimi新一代模型K2.6来了

月之暗面开源发布 Kimi K2.6 模型,在通用智能体、代码编写和视觉理解等综合能力上全面跃升。它在项测试成绩领先,能连续工作13小时,还在全栈开发、智能体协作等方面有出色表现。

AIGC开放社区
新闻资讯8

巅峰对决:最强模型GPT-5.3-Codex与Claude Opus 4.6同时发布

OpenAI和Anthropic同时发布旗舰级模型GPT - 5.3 - Codex与Claude Opus 4.6。前者有网络攻防与自主代码修复能力,被评定为网络安全高风险;后者用自适应思考与上下文压缩处理长程任务,在领域表现出色,但二者也都存在安全风险。

AIGC开放社区
开源动态8

谷歌开源Gemma 3n:2G内存就能跑,100亿参数内最强模态模型

本周五凌晨,谷歌正式发布、开源全新端侧模态大模型 Gemma 3n。它有模态设计、专为设备端优化等特性,核心是 MatFormer 架构,还采用了 PLE 技术等,在方面实现质量提升。

机器之心
算法论文8

华为攻克AI推理「想太」问题!新方法让大模型推理提速60%,准确率还高了

华为提出高效推理方法S - GRPO,突破思维链「冗余思考」瓶颈。通过“串行分组 + 衰减奖励”设计,在Qwen3上有效,推理提速60%,生成答案更精确有用,在个推理benchmark测评中表现出色。

量子位
推荐文章7

Fable 5 订阅权限又续了 5 天!与其被吊着,我找了个账单只有 1/3 的替代方案

Anthropic将Fable 5订阅权限延长至7月12日,但使用不稳定且价格贵。作者介绍OpenSquilla 0.5.0 Preview,其模型集成协作方案用国产模型组队,成本低且分数可与Fable 5打平,不过也有适用边界。

花叔