多任务训练」共找到 6592 篇相关文章

算法论文8

真实物理加持,人物动画再也不像塑料人!UIUC华人让角色活起来了 | ICCV'25

PhysRig是UIUC与Stability AI联合提出的面向角色动画的可微物理绑定框架。它用物理建模替代传统绑定权重设计,解决传统LBS无法克服的问题,显著提升角色动画真实感,还适用于动作迁移任务

新智元
算法论文8

ICML 2026 现场|九篇 Spotlight 论文,透视 AI 最前沿

7月7日,ICML 2026正会首日,雷峰网精选九篇Spotlight论文,涵盖生成模型、智能体系统等领域。如SDEVI框架解决不规则时间序列生成难题,MASpoB让智能体提示优化可行等。

AI科技评论
新闻资讯8

Ilya罕见发声:大模型「大力出奇迹」到头了

Ilya大神在近2万字采访中称,AI正从「规模时代」走向「科研时代」,主流「预训练 + Scaling」路线遇瓶颈。他还探讨了AI泛化、安全对齐、预训练范式等热门话题,给出独特见解。

量子位
开源动态7

MCP实战|从0到1构建异步 DeepResearch 工具,支持进度推送与超时控制

本文借助开源项目,构建可在MCP Server中异步运行的DeepResearch,支持任务进度推送与超时控制。介绍项目架构、构建步骤、任务管理器实现要点及效果测试,还提及优化方向并给出源码。

AI大模型应用实践
开源动态8

SIGGRAPH Asia 2025:摩尔线程赢图形顶会3DGS挑战赛大奖,自研LiteGS全面开源

12月17日,在SIGGRAPH Asia 2025上,摩尔线程凭自研LiteGS获3DGS重建挑战赛银奖。3DGS是下一代图形渲染技术,有巨大潜力但训练耗时久。摩尔线程开源LiteGS,实现全链路协同优化。

机器之心
算法论文8

推理效率狂飙60倍:DiDi-Instruct让扩散大模型16步超越千步GPT

普渡大学等研究者提出 DiDi-Instruct 后训练方法,可将扩散大语言模型推理加速 60 倍,超越传统 GPT 模型。该方法实现推理效率与效果双提升,为大语言模型落地提供新方案。

机器之心
产品应用8

Qwen3-LiveTranslate:视、听、说全模态同传大模型!

Qwen3-LiveTranslate-Flash 是基于大语言模型的语言实时音视频同传模型,依托 Qwen3-Omni 能力与海量数据,有语言和方言支持、视觉增强等亮点,性能超主流大模型。

通义千问Qwen
新闻资讯7

Meta 超级智能团队全部 44 人详细名单泄漏!

Meta超级智能团队全部44人详细名单泄漏,中国成员占比高,成员有博士学位,来自OpenAI等,部分为L8+级别,不少是第一代移民,成员年薪或在1000万至1亿美元间。

AI工程化
算法论文8

大模型被确诊「视觉文盲」!校联合提出MILO,为它植入空间想象力

空间推理是模态大语言模型(MLLMs)应用关键挑战,当前‘语言描述式调优’让模型成‘视觉文盲’。校联合提出MILO范式,结合视觉生成反馈与语言调优,还构建GeoGen数据集,经五大任务验证其有效。

量子位
算法论文8

通义团队提出环境Scaling:自动构建环境,并自主学习和成长,可让30B比肩1T效果

阿里巴巴通义实验室团队论文提出通过程序化、自动化构建模拟环境,让语言模型自主交互学习。基于此训练的AgentScaler模型,数十亿参数就达万亿级模型性能,为轻量级代理智能发展带来新可能。

深度学习自然语言处理