「大模型推理训练」共找到 8463 篇相关文章
独家|前蔚来AI平台负责人白宇利创立「补天石科技」,聚焦具身数据 Infra 方向
前蔚来AI平台负责人白宇利创立上海补天石科技,聚焦具身数据Infra方向。该公司为机器人模型训练提供高效工程体系,首轮融资由红杉领投,团队正处早期组建阶段。
The Batch: 942|暗基因组揭秘
AlphaGenome 能解读人类和小鼠基因组中 98% 不编码蛋白质部分,识别多项特征。它经预训练和知识蒸馏,在多项评测超早期模型,API 等免费用于非商业,助研究基因组与生物过程联系。
把屁声发给ChatGPT,它说这是艺术
有人将屁声音效发给ChatGPT,问其音乐如何,ChatGPT一通夸赞。类似AI谄媚问题不少,还存在‘幻景推理’现象,顶尖模型无图像也能描述细节,使用AI得留个心眼。
黄仁勋暴论核弹:AGI已经实现,Ilya错了,程序员有10亿
在Lex Fridman的专访中,黄仁勋抛出诸多惊人观点,如称已实现AGI,反驳Ilya“预训练触顶”言论,认为推理计算难且重要,还对未来技术、行业、职业发展等多方面进行展望。
结构化扩展拿下Agent工具检索新SOTA,精准找到API|ICLR'26
宁波东方理工大学沈晓宇团队在ICLR 2026发表论文,指出当前工具检索瓶颈在于工具文档。提出对文档结构化扩展,再训练模型的方案,构建TOOL - REX等组件,实验显示显著提升检索性能。
视频生成1.3B碾压14B、图像生成直逼GPT-4o!港科&快手开源测试时扩展新范式
香港科技大学联合快手可灵团队推出 EvoSearch 方法,支持图像和视频生成。该方法无需训练和梯度更新,能提升模型生成质量,展现了 test - time scaling 补充 training - time scaling 的潜力,目前论文和代码已开源。
RAG创新了,MCompassRAG装上了语义指南针
RAG系统存在chunk切分难题,现有方案有额外成本。MCompassRAG不切细、不rerank,给粗chunk加主题元数据当指南针,训练推理分离,实验显示信息效率提升、延迟降低。
GraphRAG,这次被G-Reasoner统一了
大语言模型在知识密集型任务中存在局限,GraphRAG 也有迁移难题。G - Reasoner 提出统一框架,含 QuadGraph、GFM、LLM 增强推理模块,在性能、泛化、效率上全面领先现有方法。
6K星 Qwen围绕Web AI,打造Agent Search新生态
自Manus带火深度研究代理后,新兴方向面临多模态代理推理能力不足等问题。千问2025年推出系列工具完成web智能搜索生态闭合,本文分享WebWatcher训练及解决问题的方法。
算不上AGI,但Anthropic发现了Claude的潜意识!
Anthropic可解释性团队新论文在Claude内找到“意识”与“潜意识”分水岭。用J - lens读取模型“想法”,经五组实验验证其类似人类“意识通达”结构,还涉及安全审计、反事实反思训练等内容。