「2D推理」共找到 3883 篇相关文章
Meta「透视」AI思维链:CRV推理诊断,准确率达 92%!
Meta FAIR团队在论文中提出CRV方法,可实时观察AI思维过程。它通过改造模型大脑结构,让推理可见。在算术推理实验中,检测精度提升到92.47%,还能让模型修正错误。不过该技术落地尚面临诸多挑战。
拒绝不必要Think:微软&北大提出第一种自适应大型混合推理模型
大型推理模型冗长思考开销大,微软研究院和北大提出大型混合推理模型(LHRMs),它能依查询上下文决定是否思考。介绍了两阶段训练流程、评估指标,实验显示其超越现有模型且效率高。
GPT-5.2降智遭全网差评!奥特曼慌了
OpenAI推出GPT - 5.2,却未打赢谷歌。第三方数据显示Gemini 3 Pro更优,GPT - 5.2在多项基准测试表现不佳,可信度不如GPT - 5.1,遭开发者吐槽。OpenAI为此调整策略,但仍处被动。
用3D几何先验驱动视频扩散,实现更一致的世界生成
视频扩散模型生成新视角视频时,现有方法缺显式3D结构。智象未来提出DreamWorld,用3D先验与两阶段框架,结合结构和生成能力,在多基准测试表现领先。
VLA 推理新范式!一致性模型 CEED-VLA 实现四倍加速!
近年来,VLA模型成机器人领域重要研究方向,但推理速度受限。本文提出一致性蒸馏训练、混合标签监督机制及提前退出解码策略,在多基线模型上实现超4倍推理加速,实验验证其高效通用。
「AI助手」真来了?谷歌牵头推进Agent支付协议AP2
近日谷歌宣布推出 Agent 支付协议 AP2,这是开放共享协议,为 Agent 和商家交易提供通用语言。它是 A2A 和 MCP 协议扩展,聚焦解决授权、真实性、问责三大问题,还支持多种支付类型。
Andrej Karpathy:AI本质是「软件2.0」,并非电力或者工业革命
Andrej Karpathy分享AI影响经济的思考,认为应将AI视为“软件2.0”,提出预测AI自动化能力的“可验证性”指标,回顾软件1.0,阐述软件2.0,指出“可验证性”决定AI进展的“锯齿状”前沿。
睡觉也在卷!伯克利Letta新作「睡眠时计算」让推理效率飙升
Letta和UC伯克利研究者提出「睡眠时计算」技术,能让LLM在空闲时间提前思考以提升推理效率,降低推理成本,在多数据集实验中展现优势,在软件工程任务中也有应用。
吴恩达新作:87%推理token用不着,丢掉反而快3倍
吴恩达新作Prefix Sliding指出,模型推理时丢弃中间已贬值token,只保留前缀+滑动窗口,无需训练可提速3倍,配合RL训练能将推理轨迹扩展到10万token以上。该方法为Agent场景提供新思路。
从 VLM 到 VLA,智驾距离跨过「L2.9999」还有多远?
2025 年上半年,国内智驾安全受关注,浮夸宣传行不通。文章探讨厂商智驾宣传卡「L2.9999」玄机、端到端成主流原因等,分析了 L2 与 L3 区别及事故责任界定,还提及车企应对策略。