「生成式深度学习」共找到 3916 篇相关文章
统一视觉多模态与多任务!快手可灵与港科大团队发布视频生成模型,加速真实世界理解
港科大、港中文、清华和快手可灵团队提出全新视觉框架UnityVideo,统一训练多种视觉模态,让模型更懂物理规律,视频生成更真实可控,还实现零样本泛化,在多任务表现优异。
航空学报 | 西工大余囿铮、寇家庆等:基于生成对抗网络的通航飞行器气动布局设计方法
传统飞行器气动布局设计依赖专家经验,方案多样性受限。本文基于改进的生成对抗网络,提出端到端气动布局生成框架,以机翼和通航飞行器为对象研究,验证了其在创新飞行器设计方面的潜力。
让大模型多模态检索全面超越SOTA!ReCALL框架化解生成式与判别式的范式冲突|CVPR'26
紫东太初团队联合新加坡国立大学攻克大模型检索难题,其ReCALL框架以‘诊断 - 生成 - 校准’闭环体系解决范式冲突,让大模型变身高效检索器,成果被CVPR 2026录用,刷新SOTA性能。
语言模型内部还藏着众多策略模型?自底向上强化学习重塑底层特征 | 直播预约
现有强化学习工作将语言模型作整体策略优化,研究提出以策略视角审视内部隐藏状态,分析层级和模块级策略,发现不同模型模式差异,还提出自底向上强化学习策略,为研究架起新桥梁。
这个Skill可以消除文本中AI生成的痕迹,没了AI味的内容肯定会更受人喜爱。
AI创作大爆发,但其生成内容有“机械感”。介绍了可在Claude Code使用的Skill,能消除AI生成文本痕迹,还给出手动修改方法及原则,呼吁创作者用心改内容。
从分钟级等待到20倍超速:LightX2V重写AI视频生成速度上限
今年,开源项目LightX2V在ComfyUI社区走红,单月下载超170万次。它是面向低成本、强实时视频生成的推理技术栈,能在消费级显卡上高效生成视频,还支持多种模型和硬件,覆盖不同用户需求。
可灵2.5 Turbo太凶残:30%成本暴降+效果飞跃,生成体操动作可去参赛
快手推出可灵2.5 Turbo视频生成模型,在力量感、滞空感和物理感知上进步明显。官方称其在文本响应、动态效果等维度效果提升,高品质模式成本降30%。不过,它在物理认知方面仍有欠缺。
MeanFlow再下一城,北大提出机器人学习新范式MP1,实现速度与成功率双SOTA
北大研究团队提出机器人学习新范式MP1,将MeanFlow引入机器人学习,实现毫秒级推理速度。还引入分散损失提升少样本泛化能力,在仿真和真机测试中,实现速度与成功率双SOTA。
图片生成仿真!这个AI让3D资产「开箱即用」,直接赋能机器人训练
南洋理工大学与上海人工智能实验室团队提出PhysX - Anything,首个面向仿真、具物理属性的3D生成框架。它仅需单张图像就能生成可用于仿真的3D资产,在多项测试中表现优异,有望推动3D重建范式转变。
仅靠5000+样本,全新强化学习范式让30B轻松击败671B的DeepSeek V3
传统强化学习在创意写作领域举步维艰,蚂蚁技术研究院联合浙江大学开源全新强化学习范式Rubicon,构建10000+条「评分标尺」,拓展应用至主观任务领域,其30B模型用5000样本超越671B的DeepSeek V3。