推理之王」共找到 2709 篇相关文章

推荐文章7

GPU为什么能取代CPU,成为计算领域无可争议的核心?

过去CPU是计算核心,如今GPU崛起取代。二者架构不同,GPU并行处理强。人工智能、大数据等领域需其能力,软件支持助其普及,未来或融合创新,成计算领域主角。

芯师爷
算法论文8

RL是「点金石」还是「挖掘机」?CMU 用可控实验给出答案

卡耐基梅隆大学研究者构建基于GSM - Infinite的可控合成数据框架,分析预训练、中期训练和RL对模型推理泛化能力的影响,调和了RL有效性的不同观点,为改进训练策略提供基础。

机器之心
新闻资讯7

IJCAI 2026每篇投稿收100美元,学术圈却评价颇高

当下AI学术会议投稿评审体系受大模型冲击,投稿和低质量评审激增。IJCAI 2026将采取新投稿模式,每篇投稿收100美元,主论文豁免,费用支持审稿人,学者对此多持积极态度。

机器之心
新闻资讯8

马斯克抢先谷歌一步放大招,Grok 4.1登顶LMArena,创意写作直逼GPT-5.1

谷歌Gemini 3将上线消息正热时,马斯克旗下xAI的Grok 4.1凌晨上线。它有两个“形态”,免费开放且有APP版。在LMArena测试中表现优异,事实稳定性、情商、创意写作等能力提升,实测也有不错表现。

InfoQ
推荐文章7

强化学习 AI 系统的设计实现及未来发展

本文是阿里巴巴算法专家曹宇在 AICon 2025 北京站的分享,结合算法实践展示 RL 系统现状及发展脉络,探讨未来超大规模 RL 发展方向,涉及理论基础、业界实践、开源生态及社区共建。

AI前线
算法论文8

Meta这两篇最新Agent Learning论文,有些意思!

分享Meta SuperLabs两篇Agent Learning论文,从‘如何低成本获得高质量经验’出发,形成技术链,为语言智能体进入‘规模化RL时代’提供路线图,还分析了Agent RL问题及两论文成果、对比。

PaperAgent
产品应用8

藏师傅 Kimi K2 Thinking 首测!教你用 Kimi 编程全家桶

本文首发测评藏师傅 Kimi K2 Thinking,介绍 Kimi 编程全家桶。K2 Thinking 有 Agent 化等多方面升级,还推出 Kimi CLI 工具与 KFC 套餐。作者展示全家桶使用方法并多维度测试,肯定其表现,赞 Kimi 战略清醒务实有远见。

歸藏的AI工具箱
算法论文8

EMNLP 2025 Oral|检索增强 + 两阶段微调:剑桥提出有害内容检测大模型RA-HMD,性能SOTA

多模态有害信息检测是网络内容安全治理的重难点,多模态模型在有害内容检测上有瓶颈。剑桥大学团队提出RA - HMD框架,通过两阶段微调与结构增强,结合检索增强,提升检测性能,被EMNLP 2025接收。

深度学习自然语言处理
算法论文7

多模态大模型理解物理工具吗?PhysToolBench提出了衡量多模态大模型对物理工具理解的基准

香港科技大学等团队提出 PhysToolBench,用于衡量多模态大模型对物理工具的理解。它将理解分为三个等级,测试 32 个模型,揭示了大模型在工具理解上的不足,也为未来发展指明方向。

机器之心
新闻资讯8

深度 | OpenAI携手博通自研芯片:算力终局或是垂直整合?

OpenAI与博通战略合作,2026年下半年推进研发,将部署100亿瓦定制AI芯片系统。这标志其从算力采购转向定义,是摆脱英伟达依赖的标志事件,推动AI芯片市场进入新格局。

芯师爷