多机器人协作」共找到 5077 篇相关文章

产品应用7

Qwen2.5VL又一个娱乐场景,看电影讲故事

文章聚焦Qwen2.5VL新娱乐场景“看图讲故事”。介绍视觉叙事目标、挑战,讲述基于StoryReasoning数据集微调Qwen Storyteller模型的解决思路,含核心技术,还给出实战代码及相关链接。

CourseAI
新闻资讯7

风口来了,小程序开发者必看,最高拿10万!

微信AI小程序成长计划再升级,全行业、全类目的小程序都能申请加入。重点是针对工具类小程序推出“变现激励”,达标可额外获5%广告金激励(上限10万),作者还给出实操步骤与避坑指南。

开源先锋
新闻资讯7

训练机器人方式对了吗?英伟达DreamZero双榜第一新反思

NVIDIA的DreamZero在RoboArena和MolmoSpaces基准测试双登顶。分析文章《Why is DreamZero so good at robotics?》从维度拆解其表现突出原因,质疑传统认知,如数据量并非万能,模型规模和信息输入方式也很关键。

机器之心
新闻资讯7

Meta开始用KPI考核,强迫所有员工尽可能使用AI

Meta从面试到绩效评估全方位推动员工使用AI。招聘允许用AI助手,2026年绩效评估将纳入“AI驱动的影响”,还推游戏和绩效助手鼓励员工用AI,这也是硅谷科技巨头的大势所趋。

新智元
新闻资讯8

ChatGPT智能体正式发布,个创业赛道昨夜无眠

OpenAI正式发布ChatGPT Agent,将思考与执行能力统一,可接管电脑,能处理工作和生活种事务。它优化后能力达SOTA,但也有风险。这或重塑互联网,让Agent创业者重新审视竞争力。

量子位
新闻资讯7

OpenAI自曝:AI推理砸钱越,碾压人类越狠!

OpenAI研究员探讨推理模型时代。Noam Brown强调预训练和推理范式,指出当前AI胜在通用性。推理范式成本低、效果好,如o系列模型表现出色。首席经济学家谈AI经济影响,称其重塑企业格局。

新智元
开源动态8

机器人一个会预测未来的Critic,VLA强化学习直接起飞

OpenMOSS团队开源的World Critic Model(WCM),解决了视觉 - 语言 - 动作模型强化学习(VLA - RL)中批评家模型(Critic Model)仅依赖单帧观测打分的问题。WCM让Critic学习预测执行动作后的潜在状态,代码等全开源,验证效果显著。

机器之心
推荐文章7

《动手写AI Agent》模型适配:一套代码跑通三家 LLM

上一章用火山引擎豆包 API 写了能跑的 Agent,但换模型重写代码会混乱。本章用 Adapter 模式解决问题,介绍火山引擎、Claude、OpenAI 三家 API 关键差异,还分析了 Claude 工具调用格式特殊之处。

AI Reading Hub
开源动态8

清华发布世界模型评测新标尺:直击机器人感知与行动鸿沟

清华大学等机构推出 WorldArena 评测基准,用于测试 EWM 真实能力。它融合感知与功能评估,含十六项视频指标,结合主客观评价生成 EWMScore。测试揭示模型在感知与行动上的差距,转型为实用型模型是行业挑战。

AIGC开放社区
开源动态8

刚开源的口袋级TTS,CPU 即可语言本地畅用,爽!

传统TTS模型对个人开发者和边缘设备不友好,最近Github上开源的Pocket - TTS仅100M参数,能在普通CPU上超实时语音合成,支持语音克隆,安装简单,适合种本地语音开发场景。

开源先锋