「连续时间一致性蒸馏」共找到 628 篇相关文章
不愧是中国机器人,乒乓打得太6了
清华姚班本科生苏智团队在论文中提出结合模型规划与强化学习的分层框架,让宇树G1机器人实现亚秒级反应下的稳定连续对打,在真实实验中击球和回球率高,还能连打106拍。
奥特曼:温和奇点已降临!AI最终掌控物理世界,2030年人类命运大转折
奥特曼在「温和的奇点」一文中称人类跨越AI发展「事件视界」,进入指数级加速阶段。他预测了未来5年技术时间线,还指出奇点悄然渗透,AI自转飞轮越来越快,人类迈向超级智能时代机遇与挑战并存。
大模型全面爆发,所有榜一都是Gemini!谷歌一夜站到了台前
北京时间今日凌晨,Google I/O 2025 开发者大会开启。谷歌发布或升级系列 AI 工具与服务,如升级 Gemini 模型、推出编程智能体 Jules 等,还展示视频图像生成模型、搜索与购物模式升级,展现其在 AI 应用领域强势回归。
从零开始玩转循环 (Getting started with loops)【译】
Claude Code团队将“循环”定义为AI智能体不断重复执行工作周期,直至满足预设停止条件。文章介绍了回合制、目标导向、基于时间和主动式四种循环类型、适用场景及控制token消耗方法,还给出保证代码质量的原则。
多轮Agent蒸馏终于不翻车!港中文x通义新方法成功率暴涨18点,训练还快32%
香港中文大学联合阿里通义事业群提出TCOD训练方法,解决多轮Agent蒸馏稳定性难题。它只需对现有OPD代码做极少改动,提升了模型成功率,压缩行动步数,还减少训练时间,未来或成训练长程Agent标配。
Agent-World:扩展真实世界环境,让智能体与环境协同进化!
文章提出Agent-World,将“智能体环境探索”与“自进化训练”结合,构建了1978个环境、19822个工具。实验表明,其在23个基准上一致性优于先进方法与强开源基础模型,还分析了环境规模与自进化对性能的影响。
Monet:赋予多模态大模型如人类一般的抽象视觉思考能力
文章介绍了Monet模型,它实现了训练MLLM直接在连续隐空间思考的方法,内化视觉思考能力。还阐述了多模态模型隐式推理训练的难点,提出SFT+RL训练框架,构建数据集,经测试,Monet提升了视觉推理能力。
千问负责人突然离职,阿里回应
3月4日凌晨,千问团队核心人物林俊旸突然宣布卸任,引发业内关注。其离职时间点较突然,且前后千问团队还有其他核心成员变动。3月5日,阿里巴巴CEO吴泳铭回应,称公司将坚持开源策略,加大AI研发和人才吸纳。
Seedance 2.0现象级刷屏!深度测评:复杂场景贼稳,连asmr都会?
字节上线的Seedance 2.0全网刷屏,马斯克怒赞,外国网友催更。它在多模态输入上升级,画面一致性更稳可控,还有一镜到底、完整剧情输出功能,视频长度和音效也能DIY,虽有小bug,但日常创作够用。
技术框架不重要,大厂简历不值钱?小哥不会写代码却进了Lovable,80% 靠聊天也能上生产
Lovable是当红AI产品公司,估值66亿美元,其开设全职Vibe Coder岗位。零技术背景的Lazar Jovanovic成首位该岗员工,他80%时间规划对话,介绍了Vibe Coding方法及应对问题策略,强调表达、品味等重要性。