「验证流程」共找到 1541 篇相关文章
让AI当「动作导演」:腾讯混元动作大模型开源,听懂模糊指令,生成高质量3D角色动画
3D角色动画创作面临成本高、数据稀缺等问题。腾讯混元团队研发的混元Motion 1.0动作生成基础模型于2025年12月30日开源,通过全链路算法创新,为3D角色动画生成确立新技术范式。
Meta&CMU:Token级LLM协同路由新范式
Meta AI、CMU等联合推出FusionRoute,是让多个大模型在token级协作的新范式。它能在每个token位置精准选专家,自带“急救包”。经实验验证其高效,也指出了待研究的方向。
华为推出软工代码智能体SWE-Lego,解锁SFT训练极致性能
华为研究团队推出仅基于监督微调(SFT)的软件工程代码智能体SWE-Lego,无需复杂RL流程,在SWE-bench Verified基准中表现出色,项目已开源。它有数据、训练和测试时扩展三大创新。
智能体「卷王」诞生!干活自动配结项报告,1.5张截图就把事说清了
在LLM/VLM驱动的智能体强化学习研究中,验证完成度是挑战。为此提出SmartSnap方法,让智能体成“质检员”,主动留痕存证。它有三大突破,表现惊艳,简化训练准备,让AI更可靠。
航空学报 | 西工大余囿铮、寇家庆等:基于生成对抗网络的通航飞行器气动布局设计方法
传统飞行器气动布局设计依赖专家经验,方案多样性受限。本文基于改进的生成对抗网络,提出端到端气动布局生成框架,以机翼和通航飞行器为对象研究,验证了其在创新飞行器设计方面的潜力。
模型大一统?1100多个模型殊途同归,指向一个「通用子空间」!
约翰斯・霍普金斯大学研究发现,1100多个不同神经网络,即便训练条件不同,最终权重会收敛到共享低维子空间。此研究为神经网络参数空间“通用性”提供严谨实证,虽成因待探索,但意义深远。
谷歌DeepMind团队新框架:让AI告别每次从头开始,在任务流中越用越聪明
谷歌DeepMind团队联合伊利诺伊大学提出Evo-Memory框架和ReMem架构,改变大模型只能被动检索历史的现状,让智能体实现终身学习。通过基准测试验证其有效性,实验显示ReMem优势明显,还揭示记忆复用关键因素。
通用的dLLM开发框架,让BERT掌握扩散式对话
扩散式语言模型(DLM)因缺乏易用框架和训练成本高受限。伯克利与UIUC团队基于dLLM框架,让BERT学会对话,证明‘离散扩散 + 轻量级指令微调’可赋予BERT强生成能力,还开源全流程代码。
AI编程上瘾指南,一天不用浑身难受
本文是腾讯程序员近2个月AI编程经验总结。介绍了AI编程战略价值、研发范式转变,以CodeBuddy为核心的编程方法,AI×SDLC方法论,通过三大场景实践展示其应用,并分析边界局限,最后强调组织人才发展重要性。
智源开源EditScore:为图像编辑解锁在线强化学习的无限可能
北京智源研究院团队发布 EditScore 高保真奖励模型系列,为图像编辑强化学习提供精确奖励信号。团队提出两步解决方案,开发出 EditScore 系列模型,其在多方面表现优异,还验证了两大应用场景,有深刻研究洞见。