动态训练策略」共找到 3054 篇相关文章

开源动态8

出自小米的模块化图像编辑改造:让 AI 学会「搭积木」

小米研究团队发布 Lego-Edit 图片编辑框架,将复杂编辑任务拆成工具集和调度系统,工具集模型各司其职,调度系统指挥操作。采用渐进式训练,性能优、扩展性好,体现协同智能优势。

AGI Hunt
开源动态7

号称视频编辑领域的开源nano banana来了,用文字就能改视频

DecartAI开源Lucy Edit模型,号称视频领域开源Nano Banana,能理解自然语言指令改视频。如输入指令可精准换服装等,渲染快,有身份保持和动态适配亮点,有多个版本,应用场景广。

AI工程化
开源动态8

一夜颠覆Sora神话,H200单卡5秒出片!全华人团队开源AI引爆视频圈

UCSD等机构发布FastWan系模型,用「稀疏蒸馏」训练方案,让视频去噪速度飙升70倍。FastWan在单张H200上5秒生成480p视频,模型权重等全开源,改写AI视频生成格局。

新智元
算法论文8

首次!世界模型、动作模型融合,全自回归模型WorldVLA来了

阿里巴巴达摩院提出全自回归模型 WorldVLA,首次融合世界模型与动作模型,统一文本、图片、动作理解和生成。它用独立编码器处理多模态数据,还提出策略解决误差累积问题,实验表现优异。

机器之心
算法论文8

只用2700万参数,这个推理模型超越了DeepSeek和Claude

Sapient Intelligence研究者受大脑机制启发提出分层推理模型(HRM),该模型仅2700万参数、1000个训练样本,就在复杂推理任务上超越DeepSeek和Claude等模型,还引入近似梯度等创新设计。

机器之心
新闻资讯7

WSJ:中国AI公司用“飞行硬盘箱”规避美国芯片封锁

美国限制向中国出售先进AI芯片,中国公司想出新招,工程师带硬盘到海外数据中心训练AI,再将结果带回。企业还通过多种方式绕开封锁,同时东南亚数据中心崛起,中东也成新热点。

宝玉AI
算法论文8

让AI学着“看菜下碟”!港中大等新框架让推理长度减少90%,准确率反增17%

香港中文大学等研究者提出TON选择性推理框架,使视觉语言模型能自主判断是否推理。该框架有两阶段训练机制,实验显示其让推理长度最多减90%,准确率还提升,有益模型部署。

量子位
算法论文8

揭示扩散语言模型扩展定律,人大高瓴团队与蚂蚁集团发布LLaDA MoE v2

中国人民大学高瓴人工智能学院与蚂蚁集团合作,首次系统刻画混合专家扩散语言模型扩展定律,据此训练LLaDA MoE v2,实现扩展效率与智能双重突破,将推动其迈向规模化时代。

机器之心
新闻资讯7

刚刚,英伟达向Ilya的公司砸下重金,算力要翻10倍

SSI官方宣布与英伟达达成长期战略合作,英伟达将大规模投资,助其12个月内算力扩10倍。此前SSI算力依赖谷歌TPU芯片,此次合作反映芯片厂商争夺客户策略

AI寒武纪
算法论文7

多智能体大语言模型中的人类自适应协作

尽管大语言模型有进展,但纯自治多智能体系统有局限。为此提出 HILA 框架及双环策略优化机制,结合 DLPO 的 HILA 在基准测试中表现出色,为构建 Agentic 系统提供指导。

深度学习自然语言处理