物理推理能力」共找到 4960 篇相关文章

开源动态8

具身智能算法哪家强?RoboChallenge见真章!全球首个大规模真机算法评测平台来了

Dexmal原力灵机联合Hugging Face推出RoboChallenge项目,它是全球首个大规模、多任务的真实物理机器人基准评测平台。该平台创新采用‘远程机器人’架构,有30项真实任务基准集等,已验证多种算法表现。

新智元
新闻资讯7

库克虎口夺食:马斯克盯上的北大校友AI公司被苹果抢走

苹果和马斯克旗下公司争抢Prompt AI,苹果与该公司进入后期谈判,欲买走核心团队和技术资产。Prompt AI是2023年成立的CV初创公司,旗舰产品Seemour用于提升家用摄像头智能感知能力

量子位
算法论文8

一篇大模型Agentic框架到应用最新综述

这是首篇系统拆解“大模型Agentic推理框架”的综述,不聊训练,只聚焦如何把LLM组织成会思考、协作、调工具的Agent,横跨科学发现、医疗、软件工程、社会经济模拟四大战场,给出统一语言、视角和评测。

PaperAgent
新闻资讯8

云栖大会阿里掀桌子了!Qwen3-Max、VL、Omini、Agent ... 统统发布!

云栖大会上,阿里云智能首席技术官介绍千问多款新模型发布及一款升级。如万亿参数的Qwen3 - Max,代码和Agent能力强;还有Qwen3 - Coder - Plus、Qwen3 - VL、Qwen3 - Omni、Qwen3 - LiveTranslate等模型各有亮点。

探索AGI
新闻资讯7

Chrome已死,Agent当立。 AI Chrome正式发布~

谷歌官宣为Chrome浏览器植入Gemini AI,发布10项更新,如智能体助理上线、跨标签页整合等。但用户体验不稳定,其AI能力是嫁接非原生。创业公司可放弃浏览器,拥抱智能体,利用自身优势发展。

探索AGI
新闻资讯8

Sensor Tower 25上半年AI应用报告:年轻男性用户仍占主导,垂类应用面临被「颠覆」压力

移动应用数据分析商 Sensor Tower 发布报告《State of AI Apps Report 2025》,分析移动端 AI 市场。指出 2025 上半年全球生成式 AI 应用下载和收入增长,亚洲成下载主力,AI 成应用标配,垂类应用面临挑战。

Founder Park
新闻资讯7

Pixel 10『打样』AI手机:苹果、华为、三星差几年?

谷歌发布被称为“全球最AI的手机”Pixel 10系列,全新Tensor G5+端侧Gemini Nano带来AI领先。文章将其与苹果、华为、三星手机对比,分析各品牌AI功能优劣势,指出未来手机竞争是硬件、系统与大模型的综合较量。

鲸选AI
算法论文8

LLM-based Reranker效果到底如何?一项关于SoTA模型的全面分析

在信息爆炸时代,重排序是信息检索系统核心。论文对22种重排序方法实证研究,构建无污染数据集FutureQueryEval。结果显示LLM重排序器泛化能力被高估,轻量级模型有优势,为研究和应用提供指南。

深度学习自然语言处理
新闻资讯8

北大数学家终结50年猜想!一只蝴蝶翅膀,竟难倒菲尔兹奖得主

历时50年的「十杯马提尼猜想」被北大Lingrui Ge等学者证明。该猜想连接量子物理和数学,为解「霍夫施塔特蝴蝶」之谜。他们基于「全局理论」找到对偶方程,成果发表在arXiv,还攻克另外两个关键问题。

新智元
新闻资讯7

喜当爹后,奥特曼自曝神经化学骤变!养娃能为人类做出更优AI决策

OpenAI CEO奥特曼喜当爹后称优先事项改变,神经化学有骤变。其决策能力曾受争议,现恰逢OpenAI推进“星际之门”计划,他还将AI发展比作看孩子成长,也提及行业或有泡沫。

新智元