「自蒸馏微调」共找到 1410 篇相关文章
真实评估!北理发布全球首个「全场景教育」基准,支持4000+情境
北京理工大学高扬老师团队推出EduBench,是全球首个「全场景教育」基准,涵盖9大教育场景、12个评估维度、超4000个情境。团队将数据、模型等全面开源,评估发现大模型在特殊教育场景有不足,还提出多源知识蒸馏等方法。
见证历史!DeepSeek跃居全球第二AI实验室,R1登顶开源王座,R2全网催更
昨晚,DeepSeek官宣R1完成小版本升级,开启「深度思考」功能可体验。其R1-0528性能媲美o3和Gemini 2.5 Pro,还微调了8B模型。DeepSeek成全球第二大AI实验室和开源王者,网友催更R2。
AI失忆症有了新解法,哈佛团队开发海马体仿生技术,要用AI终结人类“遗忘史”
近日,AI初创公司Engramme被曝正与投资者接洽融资约1亿美元,潜在估值达10亿美元。其联合创始人是哈佛教授加布里埃尔·克雷曼,技术基于其实验室成果,自研大记忆模型LMMs,已开放记忆API内测申请。
机器人进入“边做边学”时代:星尘发布在线强化学习框架,让动态投掷成功率提升超141%
星尘智能基座模型团队公布在线强化学习框架SmoothRL,解决异步执行环境中具身模型在线微调难题。该框架让策略更新对应硬件实际执行,攻克延迟失准问题,在多项真机测试中大幅提升任务成功率。
AI生图免训练提速1000%,办法:最简洁的“三阶段流水线”
AI画图速度慢,过往主流加速方法有局限。MrFlow团队提出三阶段流水线,在Qwen - Image等模型上实现10倍以上端到端加速,生成效果好,优势显著,还能与时间步蒸馏叠加,且完整开源。
Skills驱动推理新范式,清华&北大:Token立省59%,准确率不降反升
当前推理模型虽准确率高,但生成“思考过程”会使推理成本和延迟上升。奇元科技、清华、北大等提出TRS框架,将历史推理轨迹蒸馏成技能卡片,在推理时检索注入,实现更少Token、更高准确率。
击败PI!星动纪元登顶具身奥林匹克,狂揽三项全球冠军
在具身灵巧操作奥林匹克赛事Benjie’s Olympics中,中国具身智能公司星动纪元斩获三项全球第一,超越美国明星公司PI。其自研VLA具身模型优势显著,且已在多领域落地应用。
慕思联手华为鸿蒙,完成一场卧室里的“静默实验”|甲子光年
在AI浪潮下,睡眠场景需“静默革命”。慕思联手华为鸿蒙推出鸿蒙智选慕思智能床Pro H - Design,采用底层代码级深度共研,还自研传感技术与算法,构建闭环服务用户,重写智能床竞争逻辑。
MIDAS:快手可灵发布实时交互式数字人生成框架
近年来交互式数字人视频生成受关注,但实时处理多模态输入有挑战。快手可灵团队提出MIDAS框架,基于LLM驱动的自回归模型,结合轻量级扩散头,实现低延迟、交互式多模态控制,还构建大规模数据集等。
李飞飞的World Labs联手光轮智能,具身智能进入评测驱动时代!
李飞飞旗下World Labs与光轮智能联手,瞄准具身智能「规模化评测」问题。World Labs的Marble是生产力工具,而光轮智能有自研仿真技术体系,双方合作让规模化评测成为可能,具身智能迈入评测驱动时代。