VLA-R1」共找到 400 篇相关文章

新闻资讯7

2025 IMO真题撕碎AI数学神话,全球顶尖模型齐翻车!冠军铜牌都拿不到

2025 IMO数学竞赛中,全球顶尖AI模型均翻车。冠军Gemini 2.5 Pro仅得31分,连铜牌都拿不到。Grok - 4表现糟糕,DeepSeek - R1也令人失望。AI虽有思路,但逻辑细节不足,离成奥数大师尚远。

新智元
新闻资讯7

架构彻底重构!DeepSeek新模型代码曝光,要来的V4让国内外都坐不住了?

DeepSeek官方GitHub代码库曝光代号“MODEL1”新模型线索,或为V4内部代号。代码显示其有重大架构变更,能并行处理稀疏与稠密计算,适配英伟达新架构。此前R1发布推动中国AI开源生态发展,新模型备受期待。

InfoQ
产品应用8

AI × 老旧系统:Vibe Coding 构建 AI 迁移工具,实现 10x 端到端智能迁移

文章指出老旧系统现代化复杂且需大量人工,AI 编程工具和 Vibe Coding 带来新可能。介绍 6R 策略、绞杀模式等迁移方法,还阐述 AI 在系统分析评估、代码转换等方面的应用,最终目标是打造闭环 AI 迁移 Agent。

phodal
算法论文8

多模态模型学会“按需搜索”,少搜30%还更准!字节&NTU新研究优化多模态模型搜索策略

字节与NTU优化多模态模型搜索策略,通过搭建工具、构建数据集及设奖励机制,用强化学习训练模型,使其按需搜索。实验显示,MMSearch - R1系统少搜30%还更准,为多模态大模型发展提供洞见。

量子位
算法论文8

具身AI当立!这是我分析完7篇最新Paper得出的结论~

作者分析7篇来自蚂蚁、小米、高德的具身AI论文,认为行业要变天。蚂蚁打通全链路并开源,小米让VLA在消费级显卡跑,高德重构数据和架构。具身AI正从‘手工业’走向‘工业革命’。

PaperAgent
开源动态8

用2D先验自动生成3D标注,自动驾驶、具身智能有福了丨IDEA团队开源

IDEA团队张磊团队提出OVSeg3R开集3D实例分割学习新范式。它无需人工后处理和3D掩码标注,降低训练成本,有望让3D实例分割商业落地,可用于自动驾驶、智能家居等领域。

量子位
产品应用7

高考数学全卷重赛!一道题难倒所有大模型,新选手Gemini夺冠,豆包DeepSeek并列第二

因网友质疑上次测评不严谨,此次用六款大模型挑战含解答题的全套高考数学题。结果Gemini 2.5 Pro夺冠,Doubao和DeepSeek R1并列第二。解答题是失分重灾区,图像题难倒多模态大模型。

机器之心
新闻资讯8

从 IROS 2025谈起,智能机器人何时迎来「GPT式爆发」? | GAIR Live 019

雷峰网邀请三位嘉宾解码IROS 2025背后具身智能前沿趋势。探讨了IROS现场变化、具身智能认知升级、Sim2Real实用边界、商业落地路径等,还预测具身智能“GPT时刻”或由“World Model+VLA”组合推动。

AI科技评论
新闻资讯7

美国具身也没成熟!PI:中国公司何必总当“中国版XX”|RSS 2026

量子位参加RSS 2026后,发现国内外具身智能关注点有时差。会上听到不少与国内不同的判断,如北美具身智能公司未成熟,中国硬件领先。还探讨了世界模型与VLA、数据、全身智能及产业出海等问题。

量子位
开源动态8

RLinf上新πRL:在线强化学习微调π0和π0.5

近年来,基于流匹配的VLA模型成机器人领域前沿技术,但训练依赖大量人类演示数据。清华等机构联合推出在线强化学习微调框架πRL,提出两种微调方案,在测试平台验证了有效性,目前代码等已开源。

机器之心