视觉-语言-动作模型」共找到 1817 篇相关文章

算法论文8

推理正确率下降65.5%!斯坦福、MIT等用「不等式」拷问AI逻辑极限

语言模型在数学证明常现推理漏洞,斯坦福等高校团队提出IneqMath基准评估其严谨性。用不等式证明题切入,拆解为子任务,构建评测体系,用LLM - as - Judge审查。结果显示模型推理正确率低,存在结构性缺陷。

新智元
开源动态8

103K「硬核」题,让大模型突破数学推理瓶颈

现有大语言模型在数学推理训练时面临数据瓶颈,腾讯AI Lab与上海交大团队推出DeepMath - 103K数据集。它规模大、难度高、数据新颖、严格去污染,让DeepMath系列模型达SOTA,还能实现推理泛化。

机器之心
开源动态8

苹果在WWDC提到的本地模型,这家公司把它提速了220倍

苹果在WWDC开放本地语言模型API,让iPhone等有了“AI大脑”,但开发者面临模型运行慢问题。国产团队面壁智能发布MiniCPM 4.0,端侧处理长文本提速惊人,从多层面创新实现,还补上推理框架缺口。

花叔
新闻资讯7

12年首次大改!真有人喜欢苹果的“液态玻璃”吗?至少Flutter 开发者的噩梦开始了

在 WWDC 2025 上,苹果宣布在多操作系统引入‘液态玻璃’新视觉风格,是 12 年来最大 UI 革新。这或成苹果移动端外观重大转变,但也掩盖其 AI 落后现状,还让开发者面临功耗、适配等挑战。

InfoQ
新闻资讯7

苹果的局面,很迷惑

作者对比 Google I/O 大会上谷歌的表现,认为苹果在 WWDC 上的表现令人失望。苹果更新设计语言,其 AI 侧重端侧模型,有数据安全等优势,虽目前参数量小,但端侧 AI 或成新战场。

MacTalk
新闻资讯7

TypeScript“杀疯了”!60% 到 70% YC 创企用它构建 AI Agent,赶超 Python 有戏?

近日,Mastra AI 创始人称约 60 - 70% 的 YC X25 Agent 公司用 TypeScript 构建 AI Agent。该语言受欢迎是因其静态类型、IDE 集成优势,能提高生产力。虽 Python 仍是 AI 开发主导,但 TypeScript 正受关注。

InfoQ
新闻资讯7

Meta首席科学家LeCun:当前 AI 模型缺乏四项关键人类智能特质

在巴黎AI行动峰会上,Meta首席AI科学家Yann LeCun提出智能四项标准,指当前主流AI系统尤其语言模型在这些方面不足。他认为业界‘组合式’增强是‘功能修补’,介绍Meta‘世界模型’及V-JEPA模型。

力学与人工智能
新闻资讯8

刚刚,OpenAI挖来黑客「祖师爷」!

OpenAI近期动作不断,菲尔兹奖得主、翁荔之后,黑客圈“祖师爷”Halvar Flake(真名Thomas Dullien)官宣入职。他是BinDiff之父,在谷歌有诸多成果,还参与开源项目用Claude修bug,此时加入或因GPT安全事件频发。

新智元
新闻资讯7

刚刚!Claude Fable 5,又拿第一了

在刚刚刷新的MirrorCode排行榜上,Claude Fable 5以64%的绝对成功率登顶,成绩远超其他模型。它在不同语言上表现稳定,在稀缺语言中也只小幅度下降。这意味着前沿模型能独立完成部分中大型软件。

新智元
新闻资讯7

内存四年涨700%,长鑫LPDDR6送样能把价格打下来吗

近期“长鑫DDR6送审”刷屏,实则涉及技术进度、资本事件、供应链前置动作。文章分析长鑫进展含金量,认为国产DRAM首次和国际标准处同一窗口。此轮存储涨价因HBM抽走通用产能,长鑫或补通用市场空缺。

AI Reading Hub