动作前缀并行预测」共找到 520 篇相关文章

开源动态8

春晚武BOT论文来了!王兴兴署名,同步开源其架构

宇树发布武BOT技术论文,王兴兴署名,同步开源OmniXtreme架构。该架构通过双阶段框架,打破学习和物理可执行性瓶颈,在高保真度与可扩展性间权衡,经测试在真实硬件上表现出色。

AIGC开放社区
产品应用8

机器人GPT时刻!英伟达WAM赋予全机器人零样本操作能力

英伟达发布世界动作模型 DreamZero,通过耦合视频生成与动作预测,让机器人有物理直觉,能在陌生环境完成复杂任务。它用异构数据学习,适配不同机体,还经优化实现高速推理。

AIGC开放社区
开源动态8

机器人进入“边做边学”时代:星尘发布在线强化学习框架,让动态投掷成功率提升超141%

星尘智能基座模型团队公布在线强化学习框架SmoothRL,解决异步执行环境中具身模型在线微调难题。该框架让策略更新对应硬件实际执行,攻克延迟失准问题,在多项真机测试中大幅提升任务成功率。

AI前线
算法论文8

LaPha:你的Agent轨迹其实嵌入在一个Poincaré球?

经典强化学习动作空间离散有限,但语言模型动作空间几乎无限。上海科学智能研究院联合复旦大学提出LaPha,将智能体行为树映射到潜空间,构造密集奖励、剪枝等,在基准测试中效果显著。

机器之心
开源动态8

首创TTFA指标!港大团队开源FASTER,让VLA模型真正实现「即刻响应」

港大团队提出FASTER,重新审视动作分块策略的反应延迟问题,提出快速动作采样方法。它即插即用,已开源。通过Horizon - Aware Schedule等创新,降低TTFA、提高闭环频率,实验显示能显著提升VLA反应能力。

机器之心
开源动态7

DeepSeek开源MoE新利器LPLB:基于线性规划,专攻训练动态负载不平衡

DeepSeek在GitHub开源LPLB,这是基于线性规划的并行负载均衡器,用于优化MoE模型专家并行工作负载分配。它通过动态重排序、副本构建等机制实现动态负载均衡,支持多种拓扑结构,但也存在成本估算等局限性。

AI寒武纪
产品应用7

全球首款AI原生游戏引擎再进化:GTA6再不来,我们就AI一个

GTA 6跳票成梗,其场景常被用于研究。一个多月前全球首个AI原生UGC游戏引擎发布,如今Mirage迭代为更强大的Mirage 2,支持多样场景,与Genie 3有不同优势且已上线,不过仍有技术问题待解决。

机器之心
算法论文8

推理速度飙升5倍,苹果提出全新Multi-Token生成框架!

自回归语言模型逐词生成文本拖慢推理速度、限制并行能力。Apple提出全新框架,挖掘其对未来词元“先验知识”,通过多项技术并行预测多词元,微调预训练模型可显著提速且不损输出质量。

PaperAgent
算法论文8

JCP | 哈工大(深圳)胡钢团队:三维钝体流动中主动流动控制的深度强化跨域迁移学习

本文将基于相互信息的知识迁移学习与柔性动作 - 评论(MIKT - SAC)算法结合,解决主动流动控制中状态和动作维度的跨领域问题。应用于两个测试案例,结果显示该方法优于SAC算法,能显著减少训练时间、降低阻力系数。

力学与人工智能
开源动态8

给机器人一个会预测未来的Critic,VLA强化学习直接起飞

OpenMOSS团队开源的World Critic Model(WCM),解决了视觉 - 语言 - 动作模型强化学习(VLA - RL)中批评家模型(Critic Model)仅依赖单帧观测打分的问题。WCM让Critic学习预测执行动作后的潜在状态,代码等全开源,验证效果显著。

机器之心