开源动态8
智源开源全双工语音模型 RoboBrain - Audio
机器之心
AI 摘要
智源研究院等发布 RoboBrain - Audio,采用原生全双工架构,弃用词级对齐,引入自然独白和双训练范式。实验显示其性能领先,将丰富 RoboBrain 体系,推动具身智能体发展。
阅读原文 · 机器之心
具身智能从此「边听边说」,智源研究院开源原生全双工语音大模型RoboBrain-Audio
北京智源研究院联合多方发布原生全双工语音对话大模型 RoboBrain - Audio,采用新架构和创新训练范式,在性能上全面领先,革新音频 - 文本对齐方式,丰富了 RoboBrain 全栈体系,推动具身智能发展。

关注公众号
扫码关注
第一时间收到每日精选
相关文章
产品应用8
鹿明发布NexCore助力具身智能落地
8月19日鹿明机器人发布具身智能进化引擎Lumos NexCore,试图在数据、模型等与机器人间建立生产与运行链路,让机器人能力成可复用‘技能资产’,解决具身智能技能生产效率问题。
机器之心
新闻资讯8
王兴兴:宇树上市,“非共识”创业路迎挑战
2026年宇树科技成功上市,创始人王兴兴创业十年有诸多“非共识”观点。如高性能机器人不意味昂贵,堆数据难带来具身智能,AI强对硬件要求或降低。如今宇树成行业共识,也面临新挑战。
甲子光年
产品应用7
墨奇:Agentic - Native解具身智能长程执行难题
具身智能中长程执行成关键问题,墨奇智能发布具身模型架构MoRA,提出Agentic - Native技术路线,让Agentic能力原生存在于策略模型中,还介绍了模型内部设计、所需数据等内容。
甲子光年
算法论文7
Gemini、GPT进《我的世界》评测,新框架破瓶颈
国立清华与英伟达团队研究《VLM-AR3L》,把Gemini 2.0、GPT-4.1等拉进考场,评估视觉裁决能力。结果显示Gemini综合最稳,开源小模型特定场景反超。还提出VLM-AR3L框架破使用瓶颈,实战超人类手写奖励。
AI科技评论