知识蒸馏」共找到 591 篇相关文章

算法论文8

We-Math 2.0:全新多模态数学推理数据集 × 首个综合数学知识体系

北京邮电大学、腾讯微信、清华大学团队提出We - Math 2.0,含知识体系、数据集及训练策略,可提升模型数学推理泛化能力。该成果在X上获关注,登Huggingface Paper日榜第一。

机器之心
开源动态8

阿里开源 Vivid-VR!带来逼真连贯的视频修复

阿里开源 Vivid - VR 用于视频修复,基于 T2V 模型结合 ControlNet 保证画面一致性。它引入概念蒸馏训练策略,设计控制特征投影器和双分支 ControlNet 连接器,实验展现出优异表现。

带你学AI
算法论文8

仅有一位作者的论文,却补上了城市智能的「最后一公里」

郑宇教授用论文提出跨域多模态知识融合框架,在空气质量推断等多场景优势明显,其研究按数据选择等四阶段进行,解决数据难题,推动AI用于城市问题,为跨部门协作提供可能。

AI科技评论
推荐文章8

AI可以用任何手段、写任何东西,但你得是个“中年老登”

PingCAP 黄东旭称做 db9 项目未看到 AI 边界,语言、框架、数据库选型不再长期锁定,AI 能写任何软件。徐昊认为软件知识比代码重要,‘重写’概念或过渡。滕昱指出 AI 需‘老登’掌舵,企业软件维护仍存难题。

InfoQ
算法论文8

视频生成太慢?英伟达、谢赛宁等发布TMD框架,实现70倍加速

大规模视频扩散模型采样效率低,应用受限。英伟达联合谢赛宁等提出TMD框架,将大型视频扩散模型蒸馏为少步生成器。实验显示,TMD能实现超70倍加速,质量损失小,用户也更偏好其生成的视频。

机器之心
开源动态8

一夜颠覆Sora神话,H200单卡5秒出片!全华人团队开源AI引爆视频圈

UCSD等机构发布FastWan系模型,用「稀疏蒸馏」训练方案,让视频去噪速度飙升70倍。FastWan在单张H200上5秒生成480p视频,模型权重等全开源,改写AI视频生成格局。

新智元
推荐文章7

西方忘了怎么制造东西,现在它又在忘记代码

文章以国防工业为例,指出西方制造业存在知识流失、产能恢复困难问题。如重启“毒刺”导弹生产线困难,欧洲炮弹交付延期。软件行业也类似,AI使初级工程师能力培养受阻,可能重蹈覆辙。

宝玉AI
算法论文8

NeurIPS 2025 | 北大联合小红书提出Uni-Instruct:ImageNet单步生图FID进入1.0时代!

北大联合小红书提出的 Uni - Instruct 框架被 NeurIPS 2025 接收,它统一超 10 种单步扩散模型蒸馏方法,在多项任务达最佳性能,还能用于文本到 3D 生成。

机器之心
新闻资讯7

一个中大型组织到底需要怎样的AI办公,这场闭门会说清楚了

今年初麻省理工报告指出企业AI投入大但多数试点难量化回报。6月9日金山办公举办闭门会,探讨企业级AI问题,指出其要过数据、知识、安全三关,还给出选场景、重数据等判断。

AI寒武纪
算法论文8

告别死记硬背!SkillRL自动提炼Skills持续进化

大型语言模型智能体常孤立运行,难从经验学习。SKILLRL受人类技能启发,提出有效经验迁移需抽象。它通过经验驱动的技能蒸馏、分层技能库和递归技能进化机制,在多实验中表现出色。

PaperAgent