「两阶段后训练方法」共找到 3694 篇相关文章
Self-Forcing++:让自回归视频生成模型突破 4 分钟时长极限
加州大学洛杉矶分校与字节Seed等团队联合完成Self-Forcing++,让自回归视频生成模型突破4分钟时长极限。它解决传统模型架构缺陷,经三步技术实现稳定超长视频生成,实验超基线,但仍有长时记忆缺失等问题。
具身智能迎来ImageNet时刻:RoboChallenge开放首个大规模真机基准测试集
近日,RoboChallenge推出全球首个大规模、多任务真机基准测试。它构建开放、公正、可复现的‘真实考场’,为视觉 - 语言 - 动作模型提供评估标准,推动具身智能发展,还提供远程测试服务等。
Ilya震撼发声!OpenAI前主管亲证:AGI已觉醒,人类还在装睡
OpenAI前主管、Anthropic联创Jack Clark称AI已「活」,人类却装作没看见。他既对AI技术进步乐观,也有深切恐惧,还指出AI虽未达自我改进阶段,但未来有独立思考设计自我的可能。
OVI:统一的音视频生成模型,声音与画面同步诞生
音视频生成领域以往多阶段架构易致音画不同步等问题。耶鲁大学团队提出 OVI 统一范式,采用双塔 DiT 架构与分块式跨模态融合机制,实现音画同步生成,不过目前有计算开销大、音频有局限等问题。
如何改变AI研究范式?谷歌DeepResearch新方法TTD-DR原理与实现 | 原理篇
谷歌提出新的DeepResearch方法TTD - DR,它模拟人类研究范式,将Agent起草的初稿视为‘含噪声输出’,经多轮检索 - 改进使初稿成高质量终稿,还引入自进化机制,测试显示其在复杂任务上领先。
5大维度、4类模态:LLM/Agent数据分析技术全景图
文章分享《LLM/Agent-as-Data-Analyst: A Survey》,上交大、清华、微软等将「LLM/Agent 当数据分析师」技术拆成 5 大设计维度与 4 类数据模态,给出 100+ 代表性方法等,还介绍不同数据类型的分析技术。
复旦、同济和港中文等重磅发布:强化学习在大语言模型全周期的全面综述
来自多所顶尖科研机构的研究者完成长文综述,总结大语言模型全生命周期的强化学习研究,阐述其各阶段应用策略,分析未来挑战与趋势,重点关注 RLVR 技术,有全生命周期梳理等三大贡献。
Stability AI前CEO惊人预测:人类智力价值归零,只剩1000天!
Stability AI前CEO Emad Mostaque在节目中称,未来1000天AI将重塑经济结构,人类劳动价值或归零甚至为负。他提出「MIND框架」衡量经济,指出当前处于智能反转阶段,还探讨应对之策。
LeCun团队开源首个代码世界模型:能生成代码还能自测自修!传统编程模型一夜成古典
Meta FAIR推出全球首个代码世界模型CWM,它能生成代码、理解语义,还‘懂得’代码执行,能模拟运行过程。在多个代码与推理任务表现出色,开源代码、训练细节等,不过目前仅支持Python。
这一次,天玑9500的端侧AI能力,友商赶不上了
9月22日,联发科推出天玑9500芯片,展示新形态端侧AI应用,推动端侧AI实用化。其性能强、功耗低,还支持端侧模型训练。多家手机厂商将发布搭载该芯片的手机,展现新AI趋势。