「机器人学」共找到 1245 篇相关文章
谷歌 DeepMind 发布机器人学基础模型 Gemini Robotics On-Device
谷歌 DeepMind 推出 Gemini Robotics On-Device,这是视觉 - 语言 - 行动基础模型,可在机器人硬件本地运行,低延迟且能针对特定任务微调。它是 Gemini Robotics 家族最新迭代,还发布相关基准测试。模型待广泛可用,SDK 可在 GitHub 找到。
动物间谍:一只披着羊皮的狗……
中国科学院派披着羚羊皮的深圳云深处X30四足机器人混入可可西里藏羚羊群,观察其行为。该机器人装备多类传感器和定位系统,能实时传输数据,还可远程控制,此前也有不少用机器人研究动物的案例。
神秘具身团队又放出一连串很炸的Demo视频…自进化模型,技术路线曝光
神秘具身团队放出一连串Demo视频,其内部代号“MVP”的模型让机器人似人般思考决策。视频展示机器人在不同场景下的表现,如躲避推搡、做家务、机器人协作、高效收纳等,体现对物理规则和人类习惯的理解与自进化能力。
所有大模型,都学物理学:北大物理系一篇研究,震撼了AI圈
北大等机构团队跨界用物理学最小作用量原理,提出新颖方法估计 LLM 生成方向性,揭示其背后‘物理定律’。发现 LLM 生成有细致平衡现象,还能用物理指标给大模型画像,让 AI 研究提升到‘物理科学’高度。
为什么自监督永远学不到语义?
《Visual Language Hypothesis》论文用纤维丛理论审视视觉表征学习,指出只做连续变换难触达语义。分析现有无监督学习不足,提出“Expand - and - Snap”机制,还通过实验验证,提供审视AI架构新视角。
创新性自动化 AI 工具-终结者机器人
Terminator是最快的AI优先计算机操作SDK,用类似Playwright的API与Windows原生GUI应用交互,比基于视觉的方案更快更可靠,能操作后台应用。它重点支持Windows,部分支持macOS,暂不支持Linux。
李飞飞最新思考:语言模型救不了机器人
本文是对李飞飞的访谈编译。她指出语言模型在世界理解上有短板,空间智能是关键,还探讨了AI发展历程、世界模型重要性等,介绍其公司产品Marble,强调人人在AI时代都有位置。
刚刚,UCLA周博磊也加入了一家机器人公司
加州大学洛杉矶分校副教授周博磊官宣加入机器人初创公司Coco Robotics,同时该公司成立Physical AI Lab,周博磊任首席AI科学家。Coco积累大量数据,想借此推进自动化研发,且与OpenAI有合作。
三金,又是中国队!全球机器人视触融合挑战赛揭榜
ManiSkill - ViTac 2025视触觉融合挑战赛揭榜,全球42支团队参赛,中国两家具身初创公司包揽三金。该赛事聚焦视触觉融合技术,为机器人行业搭建从实验室到现实应用的桥梁,推动相关算法和硬件进步。
具身智能迈入下半场,RoboMemArena全面评测机器人记忆系统
香港科技大学(广州)等多机构打造具身智能评测基准 RoboMemArena,突破传统局限,构建综合评测体系,配套真机测评。它提供多模态标注,任务长程多样,开源资源易用,PrediMem 在其上表现出色。