多任务学习」共找到 6120 篇相关文章

开源动态8

首个开源模态Deep Research智能体,超越个闭源方案

首个开源模态Deep Research Agent登场,整合种工具并优化决策。其WebWatcher技术方案覆盖全链路,实验中在四大核心领域领先主流模型,展现复杂推理和信息检索实力。

量子位
开源动态7

【CUDA-MODE学习笔记】Lecture 40: CUDA Docs for Humans(文末送书

本文是CUDA-MODE课程笔记,介绍Modal公司GPU术语词汇表项目,讲师分享职业历程,强调理解CUDA技术栈各层次重要性,还讨论了项目短、中、长期目标,是助力开发者掌握CUDA的教育项目。

GiantPandaLLM
算法论文8

模仿学习新范式!Chain-of-Action:轨迹自回归实现动作推理

具身智能领域尚未迎来「GPT时刻」,现有模仿学习范式有缺陷。字节跳动与阿德莱德大学研究者提出「动作链」(CoA)策略,通过轨迹自回归建模解决累计误差,提升泛化性,实验效果显著。

机器之心
算法论文8

清华联手千问重塑归一化范式,让 Transformer 回归「深度」学习

Pre - Norm和Post - Norm是Transformer架构中稳定信号流的关键范式,但面临权衡取舍。近日,清华黄高团队联合千问团队提出SiameseNorm,构建参数共享的平行通路,实现稳定训练并提升性能。

机器之心
开源动态7

Pogocache:开源缓存软件实现低延迟并支持传输协议

全新开源缓存软件 Pogocache 近日发布 1.0 正式版,主打低延迟与 CPU 高效能特性,支持种主流通信协议,宣称比其他开源缓存方案有更高吞吐量和更低延迟。还介绍了其架构、应用场景等。

InfoQ
算法论文8

10%训练数据超越100%表现,机器人学习领域迎来重要突破

密歇根大学和瑞典皇家理工学院团队提出 ViSA - Flow 框架,能从人类视频提取语义动作流,提升机器人数据稀缺时学习效率。在 CALVIN 测试中,用 10% 训练数据超越 100% 数据方法,有技术优势也存在局限。

机器之心
算法论文8

DeepMind 颠覆机器人学习范式:让机器像人一样 “自由成长”

谷歌DeepMind受大模型微调中强化学习阶段启发,提出面向机器人学的两阶段后训练方法,含监督微调与自我提升。实验显示该方法让机器人自主习得新技能、广泛泛化,但研究也存在标注成本高等局限。

AI科技评论
推荐文章7

清华叉院教授手把手教你用强化学习训练智能体

在大模型智能体时代,智能体强化学习训练通用智能体很关键。ASearcher 是相关项目,AReaL 有交互次数和代码设计优势。本次吴翼教授将带团队成员,以轮搜索智能体为例,教用最少代码实现训练。

机器之心
产品应用8

UCSD首个智能体浏览器发布!页面设计,颠覆传统交互

加州大学圣地亚哥分校推出Orca浏览器,把网页视为可塑材料,浏览器变为可塑空间。用户能在无限画布中浏览、管理网页,调度智能体完成任务,还可进行大规模查看、管理等操作,项目将开源。

新智元
产品应用8

拖拽式搭建分布式Agent工作流!Maze让非技术人员几分钟搞定复杂任务

大模型智能体落地有诸问题,Maze分布式智能体工作流框架可提供一站式解决方案。它是集成分布式执行引擎的全能平台,有四大核心优势,还有可视化工具让非技术人员也能轻松搭建工作流。

量子位