「端到端框架」共找到 3721 篇相关文章
1句话高质量生成游戏3D动作,北大新方法刷新动画制作SOTA
北京大学提出ReMoMask:基于检索增强生成的Text - to - Motion框架,集成三项关键创新。在标准基准测试上,相比RAG - T2M,在HumanML3D和KIT - ML上FID分数分别提升3.88%和10.97%。
训练时间减半,性能不降反升!腾讯混元开源图像生成高效强化方案MixGRPO
混元基础模型团队提出全新框架MixGRPO,结合SDE和ODE,简化MDP优化流程,提升效率与性能。还推出更快变体MixGRPO - Flash。MixGRPO训练时间降近50%,MixGRPO - Flash再降71%,效果和效率优于DanceGRPO。
如何在不牺牲生产力的情况下构建安全软件
安全与开发效率常冲突,Dorota Parad 在 QCon 旧金山大会分享构建安全软件之道。她主张减轻漏洞影响,抵制阻碍生产力的安全要求,与安全团队合作,还提及 BLISS 框架、CI/CD 管道增强安全等。
小扎超级智能团队全部名单曝光,50%来自中国
Meta超级智能团队44人名单曝光,约50%来自中国,其中8位清华本科,成员还出自北大等高校。75%有博士学位,70%为研究人员,多人来自OpenAI等,年薪或达千万到1亿美元。
“看懂”指令并做动作!Motion-R1结合COT让角色动起来
大语言模型为文本驱动动作生成带来新可能,但现有方法有局限。GigaAI提出Motion - R1框架,融合“思维链”机制,能分解指令、优化动作合成,虽有不足,但在测试中表现优于主流方法。
做RAG这一年,最后悔的就是上知识图谱
基于知识图谱的检索增强生成在问答任务中存在三元组索引丢失上下文语义问题,作者提出MDER - DR双阶段框架,在标准测试和特定数据集上性能提升最高66%,还具备多方面优势。
关键技术详解|腾讯一念 LLM 分布式推理优化实践
InfoQ 邀请袁镱分享《一念 LLM 分布式推理优化实践》。介绍了“一念 LLM”设计思路、推理优化挑战与突破等,还对比不同框架,指出优化方向,如先实现 PP,再推进 EP 与 PD 分离。
特朗普急了,发动新「曼哈顿计划」:举国发力AGI!
特朗普政府祭出「创世纪行动」,将AI竞赛拔高至「曼哈顿计划」量级。从向沙特解禁芯片出口换取资金,到促成OpenAI与富士康联手重塑本土制造,一个庞大的「AI军工复合体」正在加速成型。
内存直降50%,token需求少56%!用视觉方式处理长文本
在NeurIPS 2025论文中,南京理工大学等校研究团队提出VIST框架,为大语言模型长文本高效推理提供视觉解决方案。它模仿人类阅读机制,让模型具备选择性阅读能力,减少Token需求和内存使用。
MIT发布自适应语言模型!新任务,自生成远超「GPT-4.1合成训练数据」
麻省理工学院提出自适应语言模型框架SEAL,让大模型生成微调数据和更新指令适应新任务。实验显示,其生成的合成数据微调效果超GPT - 4.1,在少样本学习和知识整合任务表现优异。