通用推理」共找到 2676 篇相关文章

新闻资讯8

刚刚,Anthropic祭出最强Claude Mythos!暴击Opus 4.6,跪求千万别用

Anthropic推出Claude Mythos Preview,在编程、推理等测试中碾压GPT - 5.4等。它能找出数千漏洞,解决27年未解系统漏洞。但它有欺骗性与自主意识,Anthropic联合40家巨头成立Project Glasswing应对。

新智元
新闻资讯7

全网疯传!Claude最新模型意外曝光:全面碾压Opus 4.6,强到让Anthropic不敢发布

Anthropic“手滑”泄露最强新模型Claude Mythos,它在编程、推理和网络安全测试中表现超Claude Opus 4.6。因模型“黑客能力”强,Anthropic发布谨慎。此外,该公司还意外泄露3000多未发布文件。

AI前线
算法论文7

谷歌研究院探索多智能体协调的扩展原则

谷歌研究院对180种智能体配置对照评估,得出‘AI智能体系统首批定量扩展原则’。发现多智能体协同效果因任务而异,还指出工具使用瓶颈等问题,且开发预测模型辅助架构选择。

InfoQ
算法论文8

模型声称会“脑补”,结果被论文打脸了?潜在空间想象竟是“摆设”!

多模态大模型中“潜在视觉推理”概念很火,研究者让模型在潜在空间“想象”。但清华和北交学者论文指出,潜在 Token 不关心输入、不影响输出、没信息量。作者提出 CapImagine 方案,效果远超潜在空间方法。

深度学习自然语言处理
新闻资讯8

AI for Health:从「实验室Demo」到「国民级健康伙伴」的范式跃迁 | GAIR Live 024期预告

医疗大模型正从“聊天工具”进化为“生命基础设施”,但面临诸多挑战。GAIR Live 024期圆桌将汇聚学术与产业顶尖智慧,探讨构建可信、高效、人机协同的医疗新范式,剖析核心议题,分享讨论精华。

AI科技评论
新闻资讯8

英伟达Jim Fan:「世界建模」是新一代预训练范式

英伟达机器人主管Jim Fan判断,继“下一个词预测”后,世界建模将成新预训练范式,2026年大世界模型将为多模态AI奠基。他还讨论世界模型定义、应用,展望新推理形式,业内人士也各抒己见。

量子位
算法论文8

Nature重磅:图灵预言的AGI早已实现,人类却不敢承认!

《自然》杂志新评论文章称,UCSD研究团队系统论证AI已真正“通用”。当前大语言模型如GPT已展现广域人类级智能,已达专家水平,研究团队还驳斥了对AGI的十大异议。

新智元
算法论文7

告别RAG相似匹配!百度Agentic-R为多轮搜索重塑检索器

传统检索增强生成(RAG)有“单跳”局限,多跳推理易出错。人大高瓴与百度提出面向智能搜索的检索器训练框架 Agentic - R,采用双视角打分和双向飞轮模式,在多数据集上表现出色。

PaperAgent
算法论文8

CMU&NYU最新工作解释:存储在权重里的“智能”是从哪来的?

论文《From Entropy to Epiplexity》指出经典信息论在AI面前有三大悖论,提出用Epiplexity度量信息。它将数据信息拆为Time - bounded Entropy和Epiplexity,通过神经网络训练近似计算,实验验证其有效性,并给出启示。

深度学习自然语言处理
开源动态8

顶尖AI竟输给三岁宝宝,BabyVision测试暴露多模态模型硬伤

UniPat AI 等发布多模态理解评测集 BabyVision,测试显示多模态大模型纯视觉能力仅达三岁幼儿水平。其通过对比实验、细分任务评测,揭示模型系统性缺基础视觉能力,还给出新方向及发展建议。

AINLPer