「多任务训练」共找到 6694 篇相关文章

产品应用8

Seedance 2.0,凭什么刷屏?

2026年2月7日,字节跳动旗下AI视频生成大模型Seedance 2.0开启内测后刷屏。它解决AI视频可用率低、成本高的痛点,引发资本市场关注,虽面临挑战,但也让AI视频成可用生产力工具。

芯师爷
算法论文8

华为发布业界首个扩散语言模型Agent,部分场景提速8倍!

华为等团队研究发现,把Agent“底座”换成扩散式大模型(DLLM),执行速度提升30%以上,部分复杂任务效率达传统AR模型8倍。其优势源于生成范式,可重塑Agent设计。

量子位
算法论文8

治好多模态近视和走神!上海大学去偏干预显著提升模型性能

多模态大模型存在“近视”和“走神”问题,总是过度关注图像底部而忽略核心内容。上海大学与南开大学研究团队用两条数学公式去偏干预,无需增加计算成本,却能显著提升主流模型视觉理解能力。

AIGC开放社区
产品应用8

首个大规模记忆湖发布,AI Infra跑步进入“记忆”时代

LLM是AI的“第一大脑”,记忆平台是“第二大脑”。当前AI企业应用进入生产力时代,竞争聚焦“隐性知识”记忆化。质变科技发布MemoryLake,具备多方面能力,在性能上优势显著,已服务众多用户和企业。

量子位
产品应用7

13 万人收藏的 Openclaw 登顶GitHub No.1!附上超绝性价比部署指南!(保姆级)

Openclaw在GitHub上Star数近13万,登上多榜单TOP1。作者介绍用GitHub Codespaces零成本搭建其服务,搭配Kimi K2.5模型和Discord应用,还给出部署步骤、常见问题解决办法及功能演示。

开源星探
开源动态8

如何科学地“设计”SFT 数据?一次关于 ODA 的完整平台级验证

大模型后训练阶段,SFT数据构建常依赖‘直觉’或‘试错’。上海人工智能实验室OpenDataLab团队发布报告,基于OpenDataArena提出新范式,将数据集构建从‘随机艺术’变为‘确定性工程’,并进行平台级验证。

深度学习自然语言处理
推荐文章8

全球爆红后,Clawdbot之父2小时深度专访:退休3年后我杀回江湖

新智元对Clawdbot之父Peter Steinberger进行近2小时专访。他分享AI编程工作流,如一天600个Commit、让AI验证代码、用多个Agent并行开发。他还讲述经历,认为AI时代程序员要关注系统架构,强调与AI融合。

新智元
新闻资讯7

AI 驱动的智能异常处置:从异常发现到根因定位

在 2025 年 QCon 全球软件开发大会(北京站)上,阿里云算法专家张颖莹分享《AI 驱动的智能异常处置:从异常发现到根因定位》。她介绍阿里云计算平台运维挑战,给出算法选型与设计思路,还提及后续平台建设规划。

InfoQ
新闻资讯8

沉痛悼念计算机科学家李未院士

2026年1月25日23时10分,著名计算机科学家、教育家李未院士因病在北京逝世,享年82岁。他是新中国第一位海归计算机博士,在多领域成果卓著,还推动北航向研究型大学转变,其离世是重大损失。

新智元
8

从入门到用好 Agent Skills,看这一篇就足够了

文章是全面的 Agent Skills 中文指南,介绍其架构理念、机制、开发指南等。Claude Skills 价值被低估,它像通用 Agent 扩展包,非技术人员也能开发,还探讨了使用、开发时机与核心运行机制。

Founder Park