后训练范式」共找到 4410 篇相关文章

新闻资讯7

Claude Code越更越废?!大厂AI主管公开怒喷思考深度暴跌,官方回应更被怼爆 :菜成AI“玩具”

Claude Code在2月更新无法用于复杂工程任务,AMD AI团队主管Stella Laurenzo分析发现其思考深度下降67%、算力消耗增加。开发者不满,Claude Code负责人回应未获认同,部分开发者考虑转用Codex。

InfoQ
新闻资讯7

陶哲轩亲测Claude跑崩电脑,全靠这份保姆级指令清单翻盘

全球顶尖数学家陶哲轩实测Claude Code,首次完全放权致电脑崩溃。拆分任务、给出「保姆级」指令,约半小时完成证明。他强调人类应保持「人类在环」,拒绝过度依赖AI。

新智元
推荐文章7

OpenAI分享了一份上下文工程实用指南。

OpenAI产品负责人Miquel联合Piotr发布Context Engineering深度指南。介绍了Context Engineering概念、6种核心上下文,指出RAG只是其中一环,还讲述信息检索的多种范式及上下文组装方法。

探索AGI
算法论文8

细粒度视觉推理链引入数学领域,准确率暴涨32%,港中文MMLab打破多模态数学推理瓶颈

香港中文大学MMLab团队发布MINT - CoT视觉推理方案,解决多模态数学推理难题。它引入特殊Interleave Token,构建专属数据集,采用三阶段训练策略,实验效果全面超越现有方法。

量子位
新闻资讯8

黄仁勋暴论核弹:AGI已经实现,Ilya错了,程序员有10亿

在Lex Fridman的专访中,黄仁勋抛出诸多惊人观点,如称已实现AGI,反驳Ilya“预训练触顶”言论,认为推理计算难且重要,还对未来技术、行业、职业发展等多方面进行展望。

量子位
算法论文8

结构化扩展拿下Agent工具检索新SOTA,精准找到API|ICLR'26

宁波东方理工大学沈晓宇团队在ICLR 2026发表论文,指出当前工具检索瓶颈在于工具文档。提出对文档结构化扩展,再训练模型的方案,构建TOOL - REX等组件,实验显示显著提升检索性能。

量子位
算法论文7

告别Reasoning模型的“灵光一现”,推理能力可控了

当前GPT - 4o、DeepSeek - R1等大模型推理的‘高级操作’随机触发,不可控。研究者受经典推理三要素启发,教会模型三种‘元能力’,经三阶段训练,模型效果提升,让推理能力可控。

深度学习自然语言处理
推荐文章8

未来已来:a16z 描绘Agent时代的开发者工作流(内含 9 大关键模式)

知名风投机构 a16z 发布 Insight,认为开发者将 AI 作为构建软件新基石,传统开发范式因 AI Agent 参与而变革。其识别出九个新兴开发者模式,预示 AI 时代开发工作新图景。

AI工程化
新闻资讯7

刚刚,北京建了一座AI工厂:目标10万P算力,日产10万亿Token!

九章云极在2026全球智算科技峰会发布AI工厂战略,含训练和Token工厂,目标10万P算力、日产10万亿Token。用DCU度量投入,Token度量产出,重构智能生产与交付体系,适配不同企业需求。

量子位
推荐文章7

从零开始200行python代码实现LLM

文章从传统思路实现诗词生成器入手,介绍了词汇表、Bigram模型等概念,接着用Python和PyTorch实现了真正的Bigram模型,阐述模型、训练等内容,最回顾成果,下一篇将基于此实现完整GPT。

OpenMMLab