云栖大会」共找到 5888 篇相关文章

新闻资讯7

Anthropic智能体:Agent也精神分裂,我们发现了多Agent协作的本质解法。

Anthropic开发者聚焦Agent,分享多智能体实战经验。Omni的Blobby出现‘精神分裂’问题,根源是内外层Agent能力认知断裂,修复方案是将工具上提。Anthropic团队则通过协商签订协议解决角色定义不一致问题。

探索AGI
算法论文8

华为中科联创模型低比特量化算法,1‰数据实现昇腾无损压缩7倍

华为诺亚方舟实验室联合中科提出CBQ后训练量化方案,仅用0.1%训练数据实现模型7倍压缩,保留99%精度。该成果登ICLR 2025 Spotlight,已加入昇腾ModelSlim工具包。

新智元
算法论文8

ICLR 2026 Oral | 没人诱导,模型也「骗人」

新加坡国立学 Bingsheng He 教授团队论文关注无诱导下模型是否诚实。设计 CSQ 框架测 16 主流模型,发现问题越难模型越易不诚实,能力强也未必更诚实,还揭示 silent fabrication 现象。

机器之心
算法论文7

多模态模型理解物理工具吗?PhysToolBench提出了衡量多模态模型对物理工具理解的基准

香港科技学等团队提出 PhysToolBench,用于衡量多模态模型对物理工具的理解。它将理解分为三个等级,测试 32 个模型,揭示了模型在工具理解上的不足,也为未来发展指明方向。

机器之心
算法论文8

多模态模型中Attention机制暗藏「骗局」,需用一个公式修正丨上×南开

上海学曾丹团队研究发现,主流VLM中attention受位置偏置和padding区域异常高attention影响,直接用其进行视觉token剪枝丢失关键信息。团队用公式对attention去偏,集成到多种剪枝方法,提升了模型性能。

量子位
开源动态8

马斯克转发字节Seed&哥商学院新基准:模型搞金融,连查个股价都能出错

字节跳动Seed团队与哥商学院推出开源金融搜索与推理基准测试FinSearchComp,含635个问题。评测显示模型处理金融任务有差距,凸显金融AI能力评估重要性,还揭示了关键能力差距。

量子位
新闻资讯7

Google说,2026年AI Agent有这五趋势!

Google Cloud发布2026年Agent趋势报告,认为能改变业务的转折点是Agentic AI,总结了五趋势,如人人都有Agent、流程自动化等,核心是让员工成Agent管理者和协调者。

探索AGI
算法论文8

CVPR 2026|突破3D空间推理瓶颈:北联合南科提出QuatRoPE,让模型精准理解三维物体关系

联合南科团队提出全新 3D 位置嵌入方法 QuatRoPE,改善语言模型 3D 空间推理痛点。还提出 IGRE 降低干扰,构建 ASR 基准评估能力。研究被 CVPR 2026 接收,代码与模型已开源。

机器之心
算法论文8

为什么模型产生幻觉?OpenAI最新研究终于搞清楚了

OpenAI发布研究论文剖析LLM幻觉根源,指出当前主流训练与评估体系是核心驱动因素之一。现行评估奖励猜测行为,幻觉起源于预训练的‘下一词预测’,论文还澄清五误区,建议改革评估体系。

AI寒武纪
算法论文8

模型长脑子了?研究发现LLM中层自发模拟人脑进化

帝国理工学院等机构研究人员发表论文,指出型语言模型(LLM)学习中自发演化出类似生物脑的协同核心结构。研究对多个模型剖析,揭示其内部处理规律,为模型可解释性开辟新路径。

机器之心