预测能力」共找到 3523 篇相关文章

算法论文8

SRO赋能Qwen-2.5-VL推理性能飙升16.8%

文本领域推理模型成就大,但多模态大型语言模型推理能力扩展遇阻,如冷启动初始化不足等。提出SRO三阶段训练框架,经测试,ReVisual - R1平均性能提升16.8%。

CourseAI
新闻资讯8

奥特曼「红色警戒」5个月后,GPT Image 2屠榜,断层领先反杀谷歌

被Google按了半年头,OpenAI祭出反杀。GPT Image 2上线12小时登顶Arena文生图榜,领先Nano Banana 2达241分。它是从零重构的通用模型,具备原生思考能力,或改写图像生成赛道规则。

新智元
算法论文8

告别盲选LLM!ICML 2025新研究解释大模型选择的「玄学」

弗吉尼亚理工大学研究团队提出 LensLLM 框架,基于 PAC - 贝叶斯泛化界限揭示 LLM 微调性能“双相演进”,可精准预测微调性能、大幅降低计算成本,为 LLM 选型提供新工具。

机器之心
推荐文章8

Sebastian Raschka 新书《从头开始推理》抢先看,揭秘推理模型基础

著名AI技术博主Sebastian Raschka新书《Reasoning From Scratch》第一章介绍LLM中推理含义、训练阶段、模式匹配与逻辑推理区别,还讲述提升推理能力方法及从头构建推理模型的重要性等内容。

机器之心
新闻资讯8

年入1400亿!奥特曼印钞机转疯了,AGI尽头是卖广告

今早OpenAI CFO揭秘成绩单,2025年ARR破200亿美元、算力达1.9GW,算力与收入深度绑定。其商业版图多元,还将涉足广告。预测2026 - 2029年收入可观,2029年或达1400 - 1500亿美元。

新智元
新闻资讯7

国产算力正在进入Token标准化时代

2026年6月17日,是石科技攒局国产异构算力创新发展论坛。其创始人闫博文认为国产算力瓶颈在工程化转化能力。是石科技正将异构算力转化为标准化Token生产能力,还启动B轮融资。

量子位
新闻资讯7

谢尔盖·布林重启「创始人模式」?谷歌组建「突击队」,重押「AI编程」

近日媒体报道,谷歌组建由研究人员和工程师构成的“突击队”,提升AI编程模型能力,推动编码工作自动化。谷歌创始人谢尔盖・布林等参与其中,因Anthropic发布模型刺激,谷歌急起直追。

机器之心
新闻资讯7

ChatGPT也上线了个人年度报告!

OpenAI 让 ChatGPT 上线「Your Year with ChatGPT」功能,根据用户过去一年对话生成专属年度回顾。报告有数据统计、聊天风格分析、年度奖项等,还能预测 2026 年,虽简洁但数据更私密真实。

新智元
新闻资讯7

Karpathy 教它的 nanochat 数单词里有几个“r”

Andrej Karpathy 教超小型语言模型 nanochat d32 数单词里字母 r 的数量,创建 SpellingBee 合成任务微调模型,虽像填鸭式教学但有效,不过小模型上下文处理能力有限。

AI工程化
开源动态7

5 分钟上手「AI 版 Chrome」,小红书发帖全程零人工,反检测封神

自从Manus产品发布,Agent赛道火热,不少大厂和创业者涌入。如今有浏览器Agent开源方案opendia,它有智能页面理解等AI能力,能用于社交媒体互动等多方面。

CourseAI