机器人交互」共找到 1459 篇相关文章

新闻资讯8

从 LLM 到 World Model:为什么我们需要能理解并操作世界的空间智能?

文章指出 LLM 仅靠语言不足以支撑真正智能,构建空间智能与世界模型成关键方向。2024 年李飞飞等创立 World Labs,11 月推出 3D 世界生成模型 Marble,本文探讨空间智能重要性及世界模型如何成转变基础设施。

海外独角兽
新闻资讯7

腾讯胡文博:引领 3D 视频世界模型新趋势丨GAIR 2025

2025年12月12 - 13日,第八届GAIR全球人工智能与机器人大会将在深圳举办。腾讯ARC实验室高级研究员胡文博将在13日《世界模型》论坛分享《迈向三维感知的视频世界模型》。他深耕视频生成模型,成果显著。

AI科技评论
开源动态8

商汤科技与南洋理工大开源空间智能多模态SOTA模型

商汤科技与南洋理工大学构建800万量级三维空间数据集,训练出开源SOTA多模态基础模型SenseNova - SI系列。该系列模型在多个权威测试中表现出色,部分超越GPT - 5,还展现出泛化等能力,且能赋能具身智能。

AIGC开放社区
8

全球首个AI Agent操作系统FlowithOS跑分超Atlas,网友:它「杀死」了比赛

AI应用初创企业Flowith推出全球首款专为AI Agent打造的操作系统FlowithOS。它能改写交互方式,功能超AI浏览器,跑分超竞品,还具记忆能力,适配多系统,已公测,或引发“AI操作系统”竞争。

机器之心
算法论文8

DeepMind再登Nature:AI Agent造出了最强RL算法!

Google DeepMind团队提出DiscoRL,让智能体在多环境交互中自主发现强化学习规则,无需人类设计。它在Atari基准中击败MuZero,在未见过的游戏中也稳定高效,相关研究登《Nature》。

新智元
新闻资讯8

李飞飞的创业公司放大招:只要一个 H100 就能跑世界模型

“AI 教母”李飞飞的创业公司 World Labs 推出高效世界模型 RTFM,只需一个 H100 GPU 就能一边和用户交互,一边实时渲染 3D 世界,显著降低硬件成本和部署难度,渲染效果也不俗。

InfoQ
新闻资讯7

王兴兴硕士论文惊现GitHub,宇树雏形那时候就有了

宇树科技CEO王兴兴近10年前的硕士毕业论文在GitHub被发现。论文提出电驱式机器人方案,奠定宇树科技雏形。其‘性价比’思想成公司立身之本,如今宇树估值百亿且将IPO。

量子位
7

The Batch: 886 | OpenAI 与 Meta 多元化其 AI 产品线

OpenAI和Meta此前专注聊天机器人,如今分别推出新举措。OpenAI推Sora 2、ChatGPT Pulse和Instant Checkout;Meta推出Vibes。新项目利用AI提升用户参与度与收入,探索社交视频领域和大模型与商务融合。

DeeplearningAI
开源动态7

能自动把PDF转换为可填写表单的开源工具,实用可落地。

CommonForms是能自动将PDF转换为可填写表单的开源工具,通过检测文本框等自动添加交互字段。它基于YOLO11做目标检测,支持CLI和API使用,有多种功能特点,能高效处理转换。

开源AI项目落地
新闻资讯8

50+ 当下 Agent 关键数据与发展趋势预测

index.dev报告整理50+条AI Agent统计数据,涵盖采用率、市场规模等。介绍技术栈各层级,如开发者层提升编码效率,知识工作者层辅助办公。还提及企业采用趋势、用户交互变化、市场规模增长等内容。

特工宇宙