多任务学习」共找到 6165 篇相关文章

算法论文8

为什么GPT-5算得出微积分,却数不清积木?

文章对GPT - 5展开系统化空间能力测评,涵盖8个基准、超10亿token成本。提出“空间智能六维图谱”,发现GPT - 5在MM和SR达人类水平,但MR、PT等方面有短板,还揭示闭源与开源模型在复杂任务上差距小等情况。

深度学习自然语言处理
产品应用7

AI改造激光焊接检测!“过杀”率暴降50%,国际头部客户产线已用上

在第三届国际供应链博览会上,广州德擎光学科技的激光焊接在线检测系统展示了AI+先进制造检测落地效果。基于深度学习的AI检测模型,使焊接检测“过杀”率降50%,产线检测精度和效率提升,已用于国际头部客户产线。

量子位
新闻资讯8

AI制造AI、仓库级Coding到Agent底座:2026奇点智能技术大会首批议题公布

2026 奇点智能技术大会将于 11 月 20 - 21 日在北京举行,同期还有 C++ 及系统软件技术大会。大会公布首批核心议题,涵盖 AI 制造 AI、AI Coding、Agent 基础设施、世界模型、具身智能等前沿技术,位专家将分享实践经验。

AI科技大本营
产品应用7

小鹏汽车:没有基座模型,何谈物理AI|甲子光年

3月2日,小鹏汽车宣布第二代VLA正式推送。何小鹏认为,端到端小模型无法让自动驾驶从L2跨越到L4,而第二代VLA开创全新物理模型范式,能直接学习真实物理世界,还在不断迭代提升。

甲子光年
算法论文8

这些大神在Meta的论文看一篇少一篇了

田渊栋团队剖析可验证奖励强化学习(RLVR)训练动态,戳破参数更新稀疏误区,提出三门理论说明其参数更新定位机制,还为RL训练算法设计提供指导,指出SFT时代参数高效微调方法在RLVR中迁移效果差。

量子位
算法论文8

让大模型学会“像人一样”查证真伪

伊利诺伊大学香槟分校等校研究团队提出训练框架Veri - R1,为大模型提供“在线查证”新范式。它借助在线强化学习、精细化奖励机制和高质量数据,让模型学会像人一样查证,在数据集上表现出色。

深度学习自然语言处理
新闻资讯8

Vibe之下,AI之上:海淀创新生态的“社区”引力法则

2025年9月17 - 21日,2025 AI创造者嘉年华在海淀中关村创业大街举办。活动由单位联合主办,含五大板块,呈现年轻化、社区化、跨界融合特点。它是读懂海淀AI实力的入口,体现其在AI科研、技术研发等方面的优势。

量子位
推荐文章7

对谈 Memories AI 创始人 Shawn: 给 AI 做一套“视觉海马体”|Best Minds

本文是对 Memories AI 创始人 Shawn 的访谈。他指出当下 AI 记忆为“上下文工程”,其团队致力于打造视觉记忆层 LVMM。还探讨了视觉与文本记忆区别、LVMM 架构及应用场景等,认为视觉记忆将成下一代 AI 核心。

海外独角兽
推荐文章8

GPT-5 = Scaling Law失效?毕树超:永远有效,因为它反应的是数据结构,客观规律

Shuchao Bi在哥大演讲阐述AI发展。回顾自监督与强化学习路径,指当前发展遇高质量数据瓶颈,认为Scaling Law不会失效。还探讨通往AGI面临的问题,畅想AI重塑世界,提出两个理解AI发展的心智模型。

AI寒武纪
新闻资讯7

3B小模型,编程得分比肩Opus 4.5,神秘模型引发热议,原是国产

最近,3B小模型VibeThinker - 3B在X上火了,它在编程等推理任务上比肩前沿大模型,体积却小很。它是国产模型,来自新浪微博团队,在各项基准测试表现出色,不过在通用知识领域表现欠佳。

机器之心