「全模态模型」共找到 8901 篇相关文章
纯靠“脑补”图像,大模型推理准确率狂飙80%丨剑桥谷歌新研究
剑桥、伦敦大学学院和谷歌团队推出基于强化学习的视觉规划(VPRL)新范式,纯靠图像推理。新框架利用GRPO后训练,准确率达80%,超文本推理至少40%,代码已开源。
通义实验室新研究:大模型自己「扮演」搜索引擎,提升推理能力无需搜索API
阿里通义实验室开源ZeroSearch,提供无需与真实搜索引擎交互的强化学习框架。它用模拟搜索环境和渐进式抗噪训练,让LLM自给自足,节省API成本,在多问答数据集表现优,为智能化检索提供新思路。
Claude1.7万字系统提示词全网刷屏!Karpathy锐评:LLM训练缺乏关键范式
Claude近1.7万字系统提示词在GitHub泄露,网友称是提示技术的金矿。大神卡帕西提出系统提示学习新范式,模拟人类经验积累,让LLM有‘记忆’功能,引发网友激烈讨论。
用AI把一段视频变成可视化网页,Google的新模型又卷飞了。
Google更新Gemini 2.5 Pro至05 - 06版。此版代码能力在WebDev Arena盲测登顶,超Claude 3.7 Sonnet;还提升视频理解,可将视频转为可视化网页,虽有产品打磨问题,但进步值得肯定。
继火爆全网的MCP后,Anthropic 推出全新整合功能,Claude再添连接利器
继MCP后,Anthropic推出全新Integrations功能,使Claude能与各种工具和应用无缝连接,提升协作能力,其研究能力也得到增强,新功能在部分计划测试,将惠及更多用户,助力高效完成任务。
陶哲轩ICM 2026:数学界迎来「百年新危机」,AI狂飙逼迫全行业重写游戏规则
7月24日,陶哲轩在ICM 2026演讲指出数学界正经历新危机,关乎价值观与工作方式。他围绕AI能力猜想探讨数学界如何应对,列举目标和风险,提出需升级目标,还介绍莱顿宣言建议。
DoorDash 如何打造了一款不完全依赖大型语言模型(LLM)的 AI 购物助手
DoorDash 分享对话式 AI 助手 Ask DoorDash 的架构,它借助 LLM、AI 代理等构建系统。测试显示其提升了结账转化率等指标,还构建自动评估框架改进质量衡量,架构分离协调与业务功能。
马斯克22万张GPU全卖给Claude用:5小时限额翻倍,双方合作建太空算力
马斯克和Anthropic签署算力合作协议,将旗下Colossus 1超算集群全部给Claude用。此前马斯克抨击过Anthropic,合作后态度转变。此交易或改写AI算力格局,且三家计划IPO的公司故事也因此改写。
2050大会 | 「AGI4Science·新生论坛——正在生长的科学地图 」嘉宾阵容全览!
2026年4月25日上午9点,2050大会将迎来“AGI4Science·新生论坛”专场。该论坛由王婷召集,以“三幕剧”展现AI for Science从理论到产业的图景,涵盖多领域,17位专家将探讨AI4S的生长与变革。
2050大会「AGI4Science·新生论坛——正在生长的科学地图 」嘉宾阵容全览!
2026年4月25日上午9点,2050大会将举办“AGI4Science·新生论坛”。论坛由王婷召集,以“三幕剧”展现AI4S从理论到产业的前沿图景。涵盖多领域,17位专家探讨AI4S生长变革,涉及聚变商用、芯片设计等议题。