开源动态8
星尘发布SmoothRL,提升机器人动态任务成功率
AI前线
AI 摘要
星尘智能针对制约具身模型在线微调难题,推出SmoothRL框架。它剔除无效预测,只对实际执行动作优化。在真机测试中,如动态投掷等任务成功率大幅提升,还让动作更平顺。
阅读原文 · AI前线
机器人进入“边做边学”时代:星尘发布在线强化学习框架,让动态投掷成功率提升超141%
星尘智能基座模型团队公布在线强化学习框架SmoothRL,解决异步执行环境中具身模型在线微调难题。该框架让策略更新对应硬件实际执行,攻克延迟失准问题,在多项真机测试中大幅提升任务成功率。

关注公众号
扫码关注
第一时间收到每日精选
相关文章
产品应用8
它石AWE3.7:具身模型通吃多场景
长期以来,机器人系统多依赖专有模型,场景变化时需重新训练。如今具身智能步入下半场,它石智航通用具身大模型AWE3.7用同一颗“具身大脑”贯通多场景,回应了通用泛化命题。
量子位
产品应用8
TwinDex:无真机数据实现机器人精细操作
自变量发布全新灵巧操作系统TwinDex,后训练阶段真机遥操数据为0,机器人就能完成多项精细操作。该系统设计有灵巧性、一致性和可扩展性,降低了对真机遥操数据的依赖,使高质量数据与真机遥操的强绑定松动。
量子位
新闻资讯8
神秘具身团队Demo:机器人似人般智能进化
神秘具身团队放出一连串Demo视频,其内部代号“MVP”的模型让机器人似人般思考决策。视频展示机器人在不同场景下的表现,如躲避推搡、做家务、机器人协作、高效收纳等,体现对物理规则和人类习惯的理解与自进化能力。
量子位
新闻资讯7
孙鹏加盟星尘智能,强化机器人后训练
9月2日消息,前字节跳动Seed团队强化学习专家孙鹏博士加入星尘智能,负责机器人强化学习方向。星尘智能有技术、资本和商业优势,孙鹏经验丰富,此次加入将助力其强化学习后训练发展。
AI前线