「反事实反思训练」共找到 2253 篇相关文章
The Batch: 942|暗基因组揭秘
AlphaGenome 能解读人类和小鼠基因组中 98% 不编码蛋白质部分,识别多项特征。它经预训练和知识蒸馏,在多项评测超早期模型,API 等免费用于非商业,助研究基因组与生物过程联系。
细粒度视觉推理链引入数学领域,准确率暴涨32%,港中文MMLab打破多模态数学推理瓶颈
香港中文大学MMLab团队发布MINT - CoT视觉推理方案,解决多模态数学推理难题。它引入特殊Interleave Token,构建专属数据集,采用三阶段训练策略,实验效果全面超越现有方法。
Alibaba开源WebDancer解决DeepResearch复杂信息检索难题
Alibaba开源WebDancer,从数据和训练阶段出发提出端到端自主信息检索代理构建范式。实验中,它在GAIA和WebWalkerQA基准测试表现出色,处理复杂信息检索优势显著。
黄仁勋暴论核弹:AGI已经实现,Ilya错了,程序员有10亿
在Lex Fridman的专访中,黄仁勋抛出诸多惊人观点,如称已实现AGI,反驳Ilya“预训练触顶”言论,认为推理计算难且重要,还对未来技术、行业、职业发展等多方面进行展望。
结构化扩展拿下Agent工具检索新SOTA,精准找到API|ICLR'26
宁波东方理工大学沈晓宇团队在ICLR 2026发表论文,指出当前工具检索瓶颈在于工具文档。提出对文档结构化扩展,再训练模型的方案,构建TOOL - REX等组件,实验显示显著提升检索性能。
布林坦承谷歌低估Transformer,“还被OpenAI挖走了Ilya”
谷歌创始人谢尔盖・布林回母校演讲,复盘谷歌发展,承认曾低估Transformer,让机会给OpenAI。还回顾谷歌诞生、AI掉队又靠Gemini 3翻盘的历程,给出对大学生、创业者建议,反思退休决定。
告别Reasoning模型的“灵光一现”,推理能力可控了
当前GPT - 4o、DeepSeek - R1等大模型推理的‘高级操作’随机触发,不可控。研究者受经典推理三要素启发,教会模型三种‘元能力’,经三阶段训练,模型效果提升,让推理能力可控。
刚刚,北京建了一座AI工厂:目标10万P算力,日产10万亿Token!
九章云极在2026全球智算科技峰会发布AI工厂战略,含训练和Token工厂,目标10万P算力、日产10万亿Token。用DCU度量投入,Token度量产出,重构智能生产与交付体系,适配不同企业需求。
阿里批准林俊旸离职,CTO周靖人接管千问!Gemini周浩确定加盟
阿里巴巴CEO吴泳铭批准林俊旸辞职,周靖人接管千问。此次人事变动突然,引发诸多猜测。阿里高层称是为扩充团队、投入资源。Gemini 3.0核心贡献者周浩据传将主导千问后训练。
从零开始200行python代码实现LLM
文章从传统思路实现诗词生成器入手,介绍了词汇表、Bigram模型等概念,接着用Python和PyTorch实现了真正的Bigram模型,阐述模型、训练等内容,最后回顾成果,下一篇将基于此实现完整GPT。