机器人操作学习」共找到 2641 篇相关文章

算法论文8

从单领域到多能力协同:数据混合如何重塑AI的强化学习

上海AI Lab的OpenDataLab团队通过大规模实验剖析可验证强化学习(RLVR)在多领域推理中的机制,发现逻辑与数学数据相互支持、代码推理有跨领域混合效应等,为构建AI推理模型提供关键发现。

深度学习自然语言处理
开源动态7

OpenAI没开源的gpt-oss基础模型,他去掉强化学习逆转出来了

OpenAI未发布gpt-oss基础模型,Cornell Tech博士生Jack Morris自行逆转gpt-oss模型强化学习,发布gpt-oss-20b-base。该模型可生成任意文本,但不再对齐,还测试了其记忆能力,介绍了诞生原理与技术细节。

机器之心
新闻资讯7

亿点点新融资砸向具身智能:斯坦福华人团队,首创“自适应机器人”品类

具身智能火热,非夕科技完成C轮亿级美元融资,由咏归基金、广发信德联合领投。该公司由斯坦福大学相关成员创立,首创“自适应机器人”品类,此轮资金用于扩产、研发及生态拓展。

量子位
推荐文章8

从WAIC上爆火的功夫机器人,看到这家央企的具身智能「真功夫」

今年4月“功夫boy”机器人出圈,3个月后的WAIC上它全新升级。其背后是中国电信人工智能研究院(TeleAI),由李学龙教授带领。他们技术栈全面,在硬件、软件、数据等方面全栈自研,还布局智传网,未来发展潜力大。

机器之心
产品应用7

Cursor发布首个编程大模型!代码生成250tokens/秒,强化学习+MoE架构

Cursor 2.0正式发布,搭载自研大模型Composer。它30秒完成复杂任务,比同行快400%,每秒生成250个tokens。还带来原生浏览器工具等新功能,基于强化学习,但模型底子透明度遭质疑。

量子位
产品应用8

机器人IRON被质疑是“真人秀”?小鹏一镜到底:七年打磨的行走答案

当IRON机器人被质疑“真人扮演”,小鹏一镜到底展示其内部结构。团队耗时七年打磨,实现轻盈稳定,其动作拟真度高模糊人机边界,是成功演示与公关案例。

搜狐看展
开源动态8

CapRL:用强化学习突破Image Captioning训练瓶颈,3B模型性能媲美72B

上海人工智能实验室联合团队发布 CapRL,首个将 DeepSeek - R1 强化学习策略用于 Image Captioning。CapRL - 3B 模型在图像描述任务媲美 Qwen2.5 - VL - 72B,已开源,团队持续迭代优化。

OpenMMLab
算法论文8

ICCV 2025 | 机器人自主探索未知复杂空间?GLEAM破解主动探索建图的泛化难题

文章聚焦机器人在未知复杂空间的自主探索建图难题。香港中文大学与上海人工智能实验室联合提出GLEAM,搭建GLEAM - Bench基准,设计通用策略,实现零样本适配未知空间,在多指标上超越先前方法。

机器之心
产品应用7

14万,家务机器人带回家!斯坦福华人博士具身创业首款产品亮相

斯坦福明星华人博士生创业机器人Memo亮相,售价2万美刀。它颜值高,能做家务,在无剪辑等的demo中有出色表现。其背后是ACT - 1模型,依赖技能捕捉手套数据训练,成本低且用户可教它新本领,预计2026年推出。

量子位
新闻资讯8

WAIC机器人探展:我被全场最靓的崽「Moz1」种草了

2025 年世界人工智能大会上,千寻智能的人形机器人 Moz1 大放异彩。它搭载自研 VLA 模型 Spirit v1,具备强大泛化能力,硬件也有多项突破。千寻智能全栈自研技术,资本持续加码,有望推动具身智能商业应用。

机器之心