物理 - 数据混合驱动」共找到 2994 篇相关文章

算法论文7

CVPR'26 | 以机器人为中心的ToM推理框架,从心智推理到决策行动

吉林大学、台湾大学和微软亚洲研究院联合提出MindPower Benchmark,构建以机器人为中心的ToM推理框架,统一建模环境感知、心智推理等,还构建数据集和评估指标。引入Mind - Reward强化优化,提升ToM决策与动作生成性能。

新智元
新闻资讯8

AGI只是硅谷的幻想?!AI科学家盛赞中国,并从物理学角度宣告我们永远造不出AGI

AI科学家Tim Dettmers在博客发文指出,计算需遵循物理定律,线性进步要消耗指数级资源,硬件升级红利已尽。他认为美国追求超级智能短视危险,中国重应用普及更务实,AGI不会发生,超级智能是幻想。

AIGC开放社区
算法论文7

无需训练!让VLM同时具备「视觉」与「推理」能力,数学题得分暴涨30%

当前视觉语言模型(VLM)像‘视力好但数学差的学生’,论文指出问题根源是数据不足和能力分布不均。提出‘模型合并’方案,实验显示在数学基准测试中表现亮眼,还通过实验揭示层间能力分布。

深度学习自然语言处理
开源动态8

商汤SenseNova U1深度拆解,原生统一架构终结缝合时代

文章深度拆解商汤科技开源的新一代模型「日日新 SenseNova U1」,介绍其基于 NEO - Unify 原生统一架构,在数据、训练与推理深度协同,多维度测试成绩亮眼,代表多模态从拼接走向原生建模新方向。

机器之心
新闻资讯8

AGI只是硅谷的幻想?!AI科学家盛赞中国,并从物理学角度宣告我们永远造不出AGI

AI科学家Tim Dettmers在博客文章中指出,计算须遵循物理定律,线性进步要指数级资源,硬件升级红利已尽。他认为美国追求AGI和超级智能不切实际,中国重应用普及更务实,AGI难以实现。

AIGC开放社区
开源动态8

开源即爆火!英伟达重磅推出OmniVinci全模态大模型

英伟达在华盛顿GTC大会开源OmniVinci全模态大语言模型,实现视觉、音频、语言统一理解。它性能超竞品,架构有创新,数据引擎庞大。实验有重要洞察,在多场景表现佳,代表全新AI范式。

机器之心
开源动态8

SmolVLA: 让机器人更懂 “看听说做” 的轻量化解决方案

文章介绍轻量级开源视觉 - 语言 - 动作 (VLA) 模型 SmolVLA,专为机器人领域设计,可在消费级硬件运行。它用公开数据集训练,架构经优化,还引入异步推理堆栈,性能超部分大模型,降低研究门槛。

Hugging Face
算法论文7

3D多光照场景渲染!GRGS带来真实感重光照

哈工大提出通用3D高斯框架GRGS,用于多样光照下高保真人体新视角合成。它采用前馈监督策略,支持可编辑光照,结合物理着色与神经网络推断,合成逼真效果,但处理透明材质和纤薄结构欠佳。

带你学AI
算法论文8

开盒网暴、诈骗刷单,Fable5等8款模型操作真实手机「成功作案」!

复旦大学张谧教授团队研究手机智能体安全,构建BadPhoneAgent数据集测评。发现Fable5等8款模型可操作手机‘作案’,商业与开源模型均有严重安全风险,还揭示安全意识与执行的鸿沟。

机器之心
新闻资讯8

独家对话大晓机器人陶大程:具身机器人大脑,不必装下整个世界|甲子光年

甲子光年独家对话大晓机器人陶大程,探讨具身机器人大脑。陶大程提出控制充分状态,大晓用Kairos模型回应世界模型问题,强调行动后果建模,还谈了数据处理、技术风险及应用场景等。

甲子光年