「图中文字」共找到 2938 篇相关文章
UC伯克利新作颠覆认知:LLM靠「自信爆表」学会推理?无需外部奖励超进化
UC伯克利华人团队发现,LLM不靠外部奖励,仅靠「自信爆棚」就能学会复杂推理。他们提出基于内部反馈的强化学习(RLIF)新范式,用INTUITOR方法让模型用自身置信度作内在奖励,在多任务中表现良好。
微软 CEO 萨提亚·纳德拉:智能体即产品,SaaS 已死?
微软 CEO 萨提亚·纳德拉在 Build 大会后接受专访,称正经历软件与智能范式巨变,AI 驱动的智能体网络将重塑企业软件未来,SaaS 会融入其中。他还分享了 AI 时代软件与商业模式变革的核心洞察。
谷歌AI Overview上线!Reddit遭殃,Agent笑了~
Google搜索兑现I/O上提到的AI搜索能力,上线AI mode、AI overview,目前部分结果中有广告。Reddit成谷歌AI首个受害者,其依赖谷歌流量且签有数据授权协议。而overview对利用browser use的Agent是利好。
大模型首次打破围棋思维「黑盒」,打通科学发现新路径!上海AI Lab发布新一代InternThinker
上海AI Lab发布新一代书生·思客(InternThinker),它是我国首个具围棋专业水平且能展示透明思维链的大模型。其得益于InternBootcamp训练环境,还在多任务混合训练中现‘涌现时刻’,背后有通专融合底层技术突破。
打破日韩技术垄断,看国产高端MLCC如何赋能AI机器人
随着数智浪潮到来,AI 赋能的机器人革命正揭开产业变革帷幕。MLCC 作为核心被动电子元器件,已渗透至现代机器人架构中六大关键模块。不同类型机器人对 MLCC 性能要求不同,微容科技构建差异化产品矩阵,打破日韩技术垄断。
搜索SEO被AI重塑,专业内容社区价值凸显 | 量子位智库报告
量子位智库报告指出,大模型颠覆传统搜索,传统SEO正被重构。实验显示近半AI回答引源自内容社区,专业话题中占比更高,知乎被引频率最高。报告认为SEO应向SPO转变,专业内容社区价值凸显。
2025美国艺术与科学院院士出炉!中国物理巨匠王贻芳,ImageNet作者李凯当选
2025年美国艺术与科学院新科院士公布,近250名院士来自16个国家,涵盖31个专业领域。计算机科学领域有Kai Li、Dawn Song等;物理领域有王贻芳、Donna Sheng等;神经科学领域有Yang Dan、Kang Shen等,微软CEO纳德拉也在名单中。
V-RAE:把「看懂视频」的能力带入生成,重新思考视频模型的潜空间
近日,新加坡国立大学 Minghui Guo 与牛津大学 Shengqiong Wu、Hao Fei 在论文中提出视频表征自编码器 V-RAE。它以冻结的视觉基础模型为编码器压缩视频特征,还引入轻量级模块聚合信息。经实验验证,其在视频生成和预测上性能出色。
都标5美元,账单差三成!OpenAI高管:token从来没法直接比价
OpenAI Codex负责人Tibo指出,不同模型对同一段文字切分的token数不同,即便单token价格相同,最终账单也可能差异很大。他还提到,token无统一计量标准,跨厂商和新旧模型计数都难通用,真正重要的是每次成功结果的成本。
ACL 2026 | Spatial-Agent:地图Agent全新概念转换范式
论文 'Spatial-Agent' 提出地理空间问答应建模为 'concept transformation',引入 GeoFlow Graph 中间表示。它从自然语言问题构建图结构,再映射到工具调用。实验显示其对地图任务有帮助,还指出构建地图类 agent 需稳定数据源等。