「AI推理能力」共找到 12096 篇相关文章
马斯克终于成『AI No.1』,6大案例看实力与水分
马斯克发布Grok 4,宣称其超越OpenAI等LLM。它屠了各种榜单,但Grok系列口碑欠佳。文中通过多案例测试,展现其在各方面的表现,如编码、数学、图像等,还提到了API速度和价格。
清华新研究,Nature+Science双杀!
清华大学李勇团队分析2.5亿篇科学文献,揭示AI for Science领域矛盾:虽助科学家个体加速,却致科学界群体注意力窄化。这由当前AI模型缺通用性导致,团队推出OmniScientist系统破局限。
Meta版「甄嬛传」!28岁天才上位,掌管6千亿命脉,AI教父愤然出走
纽约时报爆料Meta内部正上演“权力的游戏”。扎克伯格得意门生与老将冲突不断,图灵奖得主Yann LeCun或被逼离职。年初Meta还是AI开源王者,现在却面临投入与回报拷问,其最新模型“牛油果”或不再开源。
老黄再收95后华人才俊!4亿美元收购AI初创公司
英伟达老黄以超4亿美元收购95后华人王尚创立的AI初创公司CentML,员工全部打包带回。该公司能整合软硬件资源,可增强英伟达CUDA工具链。此前老黄已收购多家相关初创公司揽人才。
北大大牛团队最新顶会,首次让AI能够生成真实火焰
北京大学陈宝权教授团队提出 FieryGS 框架,被 AI 顶会 ICLR 2026 接收。它将多模态大模型、燃烧物理仿真与 3D 高斯溅射融合,首次在 3D 重建中实现物理可信、语义感知且可控的火焰合成,推动数字孪生发展。
挖掘注意力中的运动线索:无需训练,解锁4D场景重建能力
香港科技大学(广州)与地平线团队提出VGGT4D,通过分析VGGT内部机制,利用注意力层运动线索,提出无需训练框架,在动态物体分割等任务表现优异,为低成本4D重建提供新思路。
Claude Opus 5 发布:Fable 5 一半的价格,更强的编码能力
Anthropic 发布 Claude Opus 5,定价与 Opus 4.8 相同,价格是 Fable 5 的一半。它在编码、知识工作和推理上表现出色,虽有不足,如速度慢、幻觉率较高,但提供多种 effort 等级,成本低,安全对齐性好。
老黄入局吃龙虾!英伟达发布最强开源Agent推理模型
英伟达发布并开源120B参数的MoE模型Nemotron 3 Super,在多项测试中表现出色。它原生支持100万token上下文,吞吐量大幅提升。英伟达还计划五年投260亿美元构建开源AI模型,开放全参数权重等。
ICML2026 | 全新评审政策出炉!作者可选:评审是否使用AI
ICML 2026 为应对预期投稿量,提出互审数量限制和 AI 使用规定。此次引入评审类型选择机制,作者可决定评审是否用大模型,分严格禁止的政策 A 和有限制允许的政策 B,但执行或有困难。
ICLR 2026北京论文分享会启动,直击「AI龙虾」、世界模型新范式
2026 年人工智能领域,「龙虾」(OpenClaw)私人 Agent 助理成人机交互标杆,世界模型受关注。ICLR 2026 4 月将在巴西举行,机器之心 4 月 18 日在北京举办论文分享会,邀大家参与交流。