因果归因」共找到 64 篇相关文章

开源动态8

DeepSeek又拿第一!首创「因果流」视觉推理,超越Gemini

DeepSeek开源DeepSeek - OCR2,引入DeepEncoder V2视觉编码器,打破传统模型扫描限制,模仿人类视觉「因果流」逻辑。它解决了传统VLM忽略图像语义结构问题,在多项测试中表现出色,还验证了「LLM作为视觉编码器」可行性。

新智元
新闻资讯8

世界模型来了因果技术标杆!具身大脑真要长脑子了

具身智能有泛化能力瓶颈,构建‘世界模型’成热门赛道。Aether AI获2000万美元种子轮融资,走因果世界模型路线,创始人黄碧薇认为这是世界模型‘终局形态’,能让机器人理解物理规律。

量子位
开源动态8

DeepSeek 硬核开源 DeepSeek-OCR-2!弃用 CLIP 改用 Qwen,创新视觉因果流!

昨天开源社区热闹非凡,Kimi 发布 K2.5,DeepSeek 则推出 DeepSeek - OCR - 2,用 LLM 架构替换传统 CLIP 视觉编码器。它核心创新是视觉因果流,能智能规划阅读路径,性能高效且全量开源。

开源星探
算法论文8

挑战Claude4的8B Agent!NUS提出AgenTracer:面向多智能体系统的失败归因

随着大语言模型发展,多智能体系统潜力大但有系统脆弱性问题。NUS研究者在论文中提出AgenTracer框架,构建标注管线,设计AgenTracer - 8B模型,在失败归因任务上超大型闭源模型,还能助力系统自我提升。

PaperAgent
算法论文7

ICML 2025 Spotlight | 谁导致了多智能体系统的失败?首个「自动化失败归因」研究出炉

ICML 2025 Spotlight 论文提出「自动化失败归因」新方向,应对多智能体系统失败难诊断问题。构建「Who&When」基准数据集,设计三种初步方法并评估,虽现有方法表现有限,但此研究意义重大,有望助力打造更可靠系统。

机器之心
新闻资讯8

经纬领投2000万美元,Aether AI让机器人学会举一反三|甲子光年

6月18日,Aether AI获约2000万美元首轮融资。创始人黄碧薇认为主流大模型学的是相关性而非因果性,她将LLM和因果算法结合,打造因果世界模型,搭建“因果大脑”,并选择具身智能作为落地场景。

甲子光年
算法论文7

AI竟会「自己认错」?破解多智能体协作「罗生门」,斩获ICML 2025 Spotlight

多智能体AI系统任务失败后,开发者常难定位问题。PSU、杜克大学与谷歌DeepMind等机构提出「自动化失败归因」,发布Who&When数据集,探索三种归因方法,虽目前效果欠佳,但为打造可靠系统提供方向。

新智元
算法论文8

挑战Claude4的8B Agent!NUS提出AgenTracer:面向多智能体系统的失败归因

随着大语言模型发展,多智能体系统潜力大但失败率高。新加坡国立大学等机构研究者提出AgenTracer框架,构建标注管线、设计轻量级追踪器,在失败归因任务上超大型闭源模型,还能助力系统自我提升。

深度学习自然语言处理
算法论文8

大语言模型逻辑评估

现有归因问答评估方法有‘归因短视’问题,研究团队提出 LOGICSCORE 框架,从三维度量化推理质量。在多数据集测试多款 LLM,发现专有、开源模型等存在不同逻辑问题,还分析典型逻辑错误。

深度学习自然语言处理
开源动态8

DeepSeek出品,必是精品!DeepSeek-OCR 2发布:让LLM像人一样读懂复杂文档,效果超Gemini 3 Pro

DeepSeek推出DeepSeek-OCR 2,提出“视觉因果流”,以全新视觉编码器赋予模型因果推理能力。它在文档解析基准表现超Gemini 3 Pro,代码和模型权重已开源,为2D推理和原生多模态探索铺路。

AI寒武纪