「具身场景」共找到 2735 篇相关文章
必须得让AI明白,有些不该碰的东西别碰(doge)
近期类o3模型在视觉推理任务表现优异,但陷入‘盲目用工具’状态。港中文MMLab等团队提出AdaTooler-V模型,具备自适应工具使用能力,还引入指标、算法,构建数据集,在多基准测评中优势明显。
全网都吵疯了!小鹏的人形机器人,是不是真人
11 月 6 日,小鹏汽车 AI Day 2025 推出人形机器人 IRON,引发网友热议是否为真人。该机器人技术先进,外观可定制,有自研 AI 大脑。官方计划 2026 年量产,先用于自有商业场景,还将推 SDK 邀第三方共创。
顶级邪修倾囊相授!藏师傅教你速通Nano Banana
作者歸藏教大家发掘图片编辑模型Nano Banana潜力。它上线后可白嫖,让Adobe等修图软件失色。介绍使用方法、多种修图玩法及在电商、动漫修复等场景应用,称相关生意都值得用它重做。
全球首个!10万小时人类数据全开源,Hugging Face罕见站台
上周Dyna Robotics公司用超100万小时人类第一视角视频训练DYNA - 2模型,发现物理AI有Scaling Law。8月20日光轮智能宣布10万小时全模态人类行为数据EgoSuite - Open100K开源,与Hugging Face联合发布。
人形机器人不再「走走停停」:Current Robotics发布全身灵巧操作模型Curr-0
具身智能领域中,让机器人移动中精细操作一直未被很好解决。Current Robotics发布全身灵巧操作模型Curr - 0,用Single Policy统一策略,数据源于自研外骨骼系统,还构建世界模型解决评测部署难题。
00后女生躲进房间造梦:我想让1000个焦虑的人,变成一只轻盈的蝴蝶
00后女孩陈栩乐是深耕VR交互领域的创作者。她以蝴蝶为具身载体,打造VR疗愈作品《Crossing the Senses》,用点云视觉呈现自然能量交换。创作中AI助力破技术难题,她追求轻交互疗愈。
机器人看不清,蚂蚁给治好了
天下苦机器人看不清透明和反光物体久矣,问题出在深度相机。蚂蚁集团具身智能公司蚂蚁灵波开源深度视觉模型LingBot - Depth,无需换硬件,用创新算法和大量数据提升性能,还将开源数据集。
大模型狂叠 buff、Agent乱战,2025大洗牌预警:96%中国机器人公司恐活不过明年,哪个行业真正被AI改造了?
InfoQ编辑部发布《2025年度盘点与趋势洞察》,探讨大模型、Agent等领域变化,分析行业被AI改造情况。指出2025年格局重塑,竞争焦点转变,国内AI有进展但与硅谷有差距,还介绍了大模型、Agent、AI Native等发展趋势。
视觉语言模型“扫地僧”:360低调开源FG-CLIP2登顶29项全球基准测试 | 甲子光年
两周前,360人工智能研究院低调开源FG - CLIP2,它在29个公开基准测试中超越Google和Meta的模型。该模型实现局部细粒度识别和原生双语对齐,为AI视觉理解设新基准,已服务开发者并在多领域落地。
CoT 之后,CoF 如何让帧间逻辑从「隐式对齐」变成「显式思考」?
CoT 虽提升语言模型推理能力,但在 C 端场景有局限,且被质疑并非真实推理。视觉领域提出 CoF 概念,Google DeepMind 团队引入理论,让视频模型通过帧链推理提升帧间一致性,还具强大泛化能力。