触觉预判」共找到 365 篇相关文章

算法论文8

何恺明等降维打击!彻底颠覆AI生图,无需训练一步到位

何恺明团队推出生成模型MeanFlow,它跳脱传统训练范式,无需训练等,仅一次函数评估就能完成生成。在ImageNet 256×256上表现优越,缩小了一步与多步模型性能差距。

新智元
新闻资讯8

英伟达:RLP 让 AI 在训练时就学会思考

英伟达研究团队发布 RLP 技术,与传统大语言模型训练不同,它在训练阶段就让模型学会'先想后说'。通过奖励机制自我监督,实验效果惊人,性能提升显著,不挑数据,打破了大模型训练范式。

AI工程化
算法论文8

AI终于“长”进机器人身体里!机械臂学会用触觉思考

香港科技大学申亚京教授团队研发出具身机器人手臂 EmArm,实现亚毫米级触觉定位与实时‘感知 - 行动’闭环。研究还提出‘感知 - 驱动’一体化算法,为打造物理 AI 机器人提供可扩展技术路径。

DeepTech深科技
算法论文8

RLPT:腾讯混元在训练数据上实现自主强化学习

腾讯混元团队发布RLPT,是在训练数据上应用强化学习的方法,可突破大语言模型扩展瓶颈。它能让模型自主学习推理能力,无需人工标注,在Qwen3 - 4B - Base模型实验中性能显著提升。

AI工程化
算法论文8

为什么给机器人装上昂贵的触觉传感器,反而让它变笨了?

伊利诺伊大学香槟分校等多校合作研究发现,当前机器人学习主流的多传感器融合算法(特征拼接)在处理任务时存在局限,给机器人加触觉数据会使抓取成功率暴跌。研究提出组合策略解决问题,经测试效果显著。

机器之心
新闻资讯8

英伟达早不靠GPU躺赢!黄仁勋终极:10亿程序员时代将至,AI智能彻底廉价

2026 年 GTC 大会后黄仁勋接受深度访谈,他指出 AI 核心竞争转向“AI 工厂”,扩展定律沿四条路径推进,未来大量数据是合成数据。他还测程序员将达十亿级,强调人人学 AI,认为智能会商品化,人性高于技术。

AI前线
算法论文8

数据邪修大法好:仅用文本数据就能训练多模态大模型

多模态大模型研发中,行业认为无图文对就无多模态能力。但ReVision研究表明,训练阶段昂贵配对关系非必需,利用非配对数据统计信息修正文本表征,能实现跨模态互换,降低成本。

量子位
新闻资讯8

GPT-5≈o3.1!OpenAI首次详解思考机制:RL+训练才是AGI正道

OpenAI研究副总裁Jerry Tworek在播客访谈中称,GPT-5类似o3.1。他详解模型推理过程,强调RL+训练是AGI正道,肯定DeepSeek的GRPO算法,还分享自身经历及OpenAI工作结构。

量子位
新闻资讯7

3个月融资亿元,流形空间证明世界模型也需要训练 | 甲子光年

2025年5月武伟创办流形空间,成立3个月获亿元融资。他认为VLA是过渡方案,世界模型是AGI新基建。当下技术分显式物理建模和隐空间交互两派,流形空间做具身世界模型,从训练做起,还将领域模型产品化。

甲子光年
算法论文8

奖励模型终于迎来训练新时代!上海AI Lab、复旦POLAR,开启Scaling新范式

在大语言模型后训练阶段,奖励模型设计与训练是关键瓶颈。上海AI Lab、复旦推出训练奖励模型POLAR,采用策略别学习新范式,适配强化微调,性能和泛化能力强,为LLM后训练带来新可能。

机器之心