「具身基座模型」共找到 8103 篇相关文章
全国首部AI大模型私有化部署标准,公开征集起草单位和个人!
近期AI政策频出,企业对人工智能应用需求攀升,倾向私有化部署,但面临诸多问题。国内首部AI大模型私有化部署标准《人工智能大模型私有化部署技术实施与评价指南》立项,现征集起草单位和个人。
蚂蚁发布全球首个视频-动作世界模型,开源即刷新世界纪录
从Sora惊艳亮相到谷歌开放Genie 3线上体验,世界模型从概念走向交互世界。蚂蚁旗下蚂蚁灵波开源全球首个视频 - 动作世界模型LingBot - VA,可驱动机器人完成复杂操作,解决长时漂移等问题,还提出工程化解法。
统一框架下的具身多模态推理:自变量机器人让AI放下海德格尔的锤子
当前先进机器人无法像人类自如用工具,现有多模态系统有局限。自变量机器人提出端到端统一架构,以统一表示学习和多任务多模态生成解锁具身多模态推理能力,实现范式转换。
Claude新模型危险,鲍威尔召集华尔街紧急开会!全美安全股暴跌2万亿
Anthropic的新模型Mythos能力超强,被指或对金融业造成重大风险。鲍威尔和贝森特紧急召集华尔街开会预警。消息传出,美国软件板块暴跌,SaaS领域近2万亿美元市值蒸发。Anthropic拒绝向公众发布该模型,启动防御项目。
具身智能发展趋势与展望 | 中国工程科学
文章深入探讨具身智能的概念、内涵、计算框架与系统实现,梳理发展现状、趋势与挑战,强调生成式AI在其演进中的关键作用,还分析我国发展进展、风险,并给出研究方向与对策。
VLA模型为何忽视语言?破解指令跟随幻觉,分布外场景泛化新突破
当前VLA模型常依赖视觉线索而非语言指令,导致新场景表现不佳。论文提出LangForce方法,引入对数似然比损失,强化模型对语言的依赖,提升分布外泛化能力,还保留语言核心功能。
超越纯视觉模型!不改VLM标准架构,实现像素级深度预测
Meta开源DepthLM,首证视觉语言模型不改架构,也能媲美纯视觉模型的3D理解能力。它通过视觉提示等策略,解锁VLM多任务处理潜力,为自动驾驶等领域带来前景。
三个理想火枪手创业,打破具身最快百台交付纪录
至简动力由理想智驾团队三位核心负责人创立,7月6日宣布首款全场景机器人i7 Pro完成首批百台交付,创下具身智能行业最快纪录。其与绿的谐波子公司合作落地全球首个CNC智能化具身机器人产线,i7 Pro还进入多场景。公司计划进入多领域,将发布新品。
AI为啥不懂物理世界?李飞飞、杨立昆:缺个「世界模型」,得学大脑新皮质工作
近来,杨立昆计划离开Meta创立以‘世界模型’为核心的AI公司;此前李飞飞也发文指出大语言模型弊端,强调建立‘世界模型’重要性。该模型源于对大语言模型局限的反思,能让AI理解物理世界。
当大模型陷入幻觉循环,如何用工程化给它“立规矩”?
普林斯顿和伯克利研究定义“机器胡扯”,指出大模型胡扯问题。蚂蚁集团旗下蚂蚁密算在2025 WAIC提出高阶程序(HOP)框架,为大模型注入规则,还开源此框架,其在多行业场景应用效果良好。