多任务学习」共找到 6139 篇相关文章

算法论文8

无需SFT也不用RL,样本级推理优化神器SLOT来了,准确率轻松+10%

西湖大学MAPLE实验室开发的SLOT方法,无需SFT和RL,让模型推理时“临时学习”具体问题。它简单易实现,计算开销小,能使模型准确率大幅提升,还无需额外资源,在各规模模型上效果显著。

机器之心
新闻资讯8

李飞飞发布:全球首个模态世界模型

李飞飞团队的World Labs发布全球首个模态世界模型Atlas,是模态自回归扩散Transformer,能相机控制生成、3D重建等,已向部分伙伴开放早期访问,未来将成底层模型。

量子位
产品应用7

体验了两周Robot Phone,这是我第一次觉得手机活过来了。

作者体验两周荣耀Robot Phone后分享感受,它是有瑕疵但具探索感的产品,独特在云台与YOYO结合,带来新奇体验,解决自媒体人刚需,还让手机从工具迈向伙伴,使手机品类重获趣味。

数字生命卡兹克
新闻资讯8

Qwen3.8-Max 正式版终于发布了,能不能打过 GPT 看这里

Qwen 3.8 Max 正式发布,沿用 Qwen 3.5 架构,参数量扩展,重点提升 Coding、Work 和 Agent 能力。它将开放权重,价格有优势。在项测试中表现出色,还新增模态能力,已可使用并有优惠。

MacTalk
产品应用8

我手机里装了20个AI,最后发现只需要一个

AI工具爆炸,人们成了「AI项目经理」。百度DuMate在开发者大会展示强大能力,一句话可让三件不同工作并行执行,有技术架构支撑,已获认证且成本下降,入口之争本质是生态之争。

新智元
算法论文8

去掉像素中介!上海交大让AI边看边想边画,用同一个“大脑”跨模态推理

上海交大等团队提出LatentUM架构,摒弃像素解码中介,在共享语义潜空间跨模态思考。它用MBAQ技术转化视觉特征,设计MoME架构,还能自我反思、规划路线、模拟世界演变,表现出色。

AIGC开放社区
算法论文8

让大模型异步地增强推理能力

在大模型推理时代,Test - Time Scaling成提升能力重要方向,但面临效率问题。ATTS提出异步框架,加入共形预测筛选候选路径,实验显示其加速显著,将测试时扩展推进到‘有原则加速’阶段。

深度学习自然语言处理
算法论文8

USC团队发布HumDex:攻克人形机器人数据瓶颈,低成本实现全身灵巧操控

南加州大学团队提出HumDex系统,结合高精度便携追踪、手部控制算法和人类数据预训练机制,打破人形机器人高质量数据采集瓶颈,提升全尺寸操作泛化能力,经实验验证效果显著。

机器之心
开源动态8

10 万 Star 的反常识:AI 写代码的瓶颈从来不是代码本身

GitHub上的Superpowers开源项目,半年攒10.9万Star。它是AI编程工具的工作流操作系统,让AI像工程师工作,有面试需求、细化计划等流程,内置14个技能,安装简单,理念超前但也有局限。

CourseAI
算法论文8

如何训练VLA?丰田研究院发布史上最大实验规模「保姆级」教程

丰田研究院和清华大学发布教程,用大量数据训练89个策略模型并验证。聚焦Co - training,研究五大模态、三种策略,对比不同架构,揭示有效和无效模态,还探讨CoT推理及方面实验。

机器之心