OCR 和知识学习范式」共找到 1886 篇相关文章

算法论文8

6款小游戏难倒所有顶级VLM!愤怒的小鸟让它们全军覆没,性能不如随机猜测

淘天集团未来生活实验室提出首个系统性评估多模态大模型(VLM)交互式物理推理能力的综合基准DeepPHY。它集成六个物理环境,对17个主流VLM测试,揭示其在物理交互等方面短板。

量子位
新闻资讯7

马斯克Grokipedia刚上线就「翻车」?被指照抄维基,中文支持一塌糊涂

马斯克预热数月的开源百科平台 Grokipedia 刚上线就遭质疑。它挑战维基百科,强调准确中立,但被指照抄且有偏见,中文支持差,目前文章数量与维基差距大,不过编辑模式也有其价值。

机器之心
推荐文章7

Learn to Reason _ The way of Baichuan-M1-ClinicReasoning

前百川智能研究小组负责人阎栋分享大语言模型临床推理。回顾推理技术发展,以Deepseek为例;介绍百川在医疗推理实践,模型达三甲主治水平;还谈及大模型训练困境及与人类智能差异。

InfoQ
开源动态8

首个基于 MCP 架构的低代码 RAG 框架

检索增强生成系统复杂度提升,科研人员面临高昂工程成本。清华大学等联合推出 UltraRAG 2.0,基于 MCP 架构,降低复杂 RAG 系统技术门槛与学习成本,支持低代码构建复杂系统。

GitHubStore
新闻资讯7

我潜伏进了"年入百万"的AI自习室,发现了一些灰色的秘密。

作者潜伏进AI自习室,发现其生意火热。AI学习机功能普通,价格却高,主要卖点是内置课程。AI督学职责是托管和销售。AI自习室盈利宣传有水分,实则钻政策空子赚教育焦虑的钱。

数字生命卡兹克
推荐文章8

科普向:一文解构大模型后训练,GRPO和它的继任者们的前世今生

文章深入解读大模型后训练,先对比 PPO 与 GRPO,指出 GRPO 优势及成本问题。又介绍 GRPO 后续改进算法,如 DAPO 解决训练问题、GSPO 提升训练稳定性、GFPO 可优化多属性,还提及 GRPO 其他缺陷。

机器之心
推荐文章7

“都什么年代了程序员还在手搓代码,连小白都能写 Prompt 生成代码了”

现在很多人标榜用 AI 写代码高效,贬低手搓代码。作者认为两者都是写代码的手段,不是目的,不能对立。并从多方面分析适合 AI 或手搓代码的场景,强调二者搭配使用能事半功倍。

宝玉AI
开源动态7

三个月、零基础手搓一块TPU,能推理能训练,还是开源的

加拿大西安大略大学工程师暑期打造开源 ML 推理、训练芯片 TinyTPU。他们非专业出身,从基础学起。还介绍了造 TPU 原因、硬件知识、构建方法,及推理、训练的实现。

机器之心
产品应用7

6K星 Qwen围绕Web AI,打造Agent Search新生态

自Manus带火深度研究代理后,新兴方向面临多模态代理推理能力不足等问题。千问2025年推出系列工具完成web智能搜索生态闭合,本文分享WebWatcher训练及解决问题的方法。

CourseAI
新闻资讯8

机器人顶会RSS 2025奖项公布!大牛Pieter Abbeel领衔研究获杰出Demo奖

机器人顶会 RSS 2025 于 6 月 21 - 25 日在美国洛杉矶举行,公布多个奖项。如杰出 Demo 奖论文提出 MuJoCo Playground 开源机器人学习框架,简化全流程,可分钟级训练策略。

机器之心