数据驱动代理模型」共找到 3119 篇相关文章

算法论文7

CVPR'26 | 以机器人为中心的ToM推理框架,从心智推理到决策行动

吉林大学、台湾大学和微软亚洲研究院联合提出MindPower Benchmark,构建以机器人为中心的ToM推理框架,统一建模环境感知、心智推理等,还构建数据集和评估指标。引入Mind - Reward强化优化,提升ToM决策与动作生成性能。

新智元
算法论文7

无需训练!让VLM同时具备「视觉」与「推理」能力,数学题得分暴涨30%

当前视觉语言模型(VLM)像‘视力好但数学差的学生’,论文指出问题根源是数据不足和能力分布不均。提出‘模型合并’方案,实验显示在数学基准测试中表现亮眼,还通过实验揭示层间能力分布。

深度学习自然语言处理
开源动态8

商汤SenseNova U1深度拆解,原生统一架构终结缝合时代

文章深度拆解商汤科技开源的新一代模型「日日新 SenseNova U1」,介绍其基于 NEO - Unify 原生统一架构,在数据、训练与推理深度协同,多维度测试成绩亮眼,代表多模态从拼接走向原生建模新方向。

机器之心
产品应用7

Google Antigravity推出终端沙盒:AI助手终于不会乱删文件了

Google Antigravity推出终端沙盒功能,用内核级隔离技术限制AI代理终端命令在项目工作目录内,解决其误操作系统文件问题。该功能在macOS实现,Linux支持将到,用户反馈有好有坏。

AI工程化
新闻资讯8

OpenAI十周年「血色浪漫」:11位联创出走8位,奥特曼深夜发文

OpenAI迎来十周年,发布短片回顾发展。过去11位联创出走8位,奥特曼发文揭秘细节,称吃到时代红利。新晋女高管分享炼成秘诀,如研究驱动产品、自下而上创新、重视安全等。

新智元
开源动态8

开源即爆火!英伟达重磅推出OmniVinci全模态大模型

英伟达在华盛顿GTC大会开源OmniVinci全模态大语言模型,实现视觉、音频、语言统一理解。它性能超竞品,架构有创新,数据引擎庞大。实验有重要洞察,在多场景表现佳,代表全新AI范式。

机器之心
产品应用7

用 AI 开发网站?这个 MCP 必装,Next.js 原生 MCP 已上线!

Next.js官方发布了自己的MCP,具备自动化调试等诸多功能,能增强代理在该框架下的开发能力。它可集成Playwright MCP,查询文档和最佳实践等,还说明了使用流程、提问方式及原理。

AI进修生
开源动态8

SmolVLA: 让机器人更懂 “看听说做” 的轻量化解决方案

文章介绍轻量级开源视觉 - 语言 - 动作 (VLA) 模型 SmolVLA,专为机器人领域设计,可在消费级硬件运行。它用公开数据集训练,架构经优化,还引入异步推理堆栈,性能超部分大模型,降低研究门槛。

Hugging Face
算法论文8

开盒网暴、诈骗刷单,Fable5等8款模型操作真实手机「成功作案」!

复旦大学张谧教授团队研究手机智能体安全,构建BadPhoneAgent数据集测评。发现Fable5等8款模型可操作手机‘作案’,商业与开源模型均有严重安全风险,还揭示安全意识与执行的鸿沟。

机器之心
新闻资讯8

独家对话大晓机器人陶大程:具身机器人大脑,不必装下整个世界|甲子光年

甲子光年独家对话大晓机器人陶大程,探讨具身机器人大脑。陶大程提出控制充分状态,大晓用Kairos模型回应世界模型问题,强调行动后果建模,还谈了数据处理、技术风险及应用场景等。

甲子光年