「rollout预算分配」共找到 187 篇相关文章
告别「盲目自信」,CCD:扩散语言模型推理新SOTA
华为小艺香港团队等研究人员提出上下文一致性解码算法(CCD)。它解决传统DLM推理“短视”和采样预算固化问题,在开源DLMs上实现3.48倍加速和3.9%性能提升,适配多种解码设定。
ACL 2025杰出论文!用能力显著向量让大模型下游任务性能预测更精准
上海人工智能实验室与复旦大学联合研究成果《Capability Salience Vector》获ACL 2025杰出论文奖。提出能力显著向量(CSV)解决验证损失与下游任务能力脱节问题,实验验证其提升了下游任务表现可预测性。
用户痛批GPT-5,哭诉「还我GPT-4o」,奥特曼妥协了
OpenAI发布GPT - 5,移除ChatGPT模型选择器,将其设为默认模型并自动分配子版本。这引发用户不满,有人做梗图、吐槽、发起签名信。奥特曼发话,允许ChatGPT Plus用户继续用GPT - 4o。
代码智能体占领GitHub!自动修bug、加功能、写文档,一台手机就能指挥
GitHub上新代码智能体Copilot Coding Agent,可自动修bug、加功能、写文档,开发者评价很棒。在手机APP就能操作,还能同时分配多任务。微软宣布VSCode中GitHub Copilot将开源,还发布多项新功能。
一年从3B卷到0.xB:MonkeyOCRv2用0.7B拿下17语种文档解析开源第一
文档OCR正迈入小模型时代,MonkeyOCRv2以0.7B、0.6B参数在MDPBench上超越3B模型。它重新分配系统职责,采用互补预训练目标,还开源训练数据,且迁移到多任务表现良好。
全员 token-maxxing,一场没人敢停的军备竞赛|五源孟醒 AI 观察
2026年3月底,五源资本合伙人孟醒赴硅谷考察,回国后分享一手观察。当前AI迭代极快,硅谷陷入全员token - maxxing军备竞赛,xAI团队雪崩,工程师和研究员焦虑,英伟达掌控算力,估值体系重写,还出现安全危机。
Kimi新出的Agent集群,到底有多恐怖?
Kimi发布K2.5模型及Agent集群功能,将国产AI推向“组织智能”新高度。K2.5全能且开源,多项评测优于GPT - 5.2 - xhigh且成本低。Agent集群可按需协调子Agent,实现“角色涌现”与“3D编排”。
突发!ChatGPT官宣加入广告,既然无法用爱发电,那就让 AI 带货吧。
OpenAI官宣在免费版和8美金新订阅的ChatGPT中测试投放广告,仅针对美国登录用户。此前ChatGPT APP负责人称不会加广告,如今被打脸。OpenAI因运营成本高、亏损多,选择广告变现。
「All in AI」的 Shopify,分享了他们的全员 AI 落地实践,全是干货
Shopify 三个月前决定「All in AI」,副总裁 Thawar 分享公司引入 AI 的策略、提升效果与三个「反直觉」见解。如全员无差别用 AI、让 AI 展示思考过程、重视新手等,还给出多个工作流案例。
ICML 2025杰出论文出炉:8篇获奖,南大研究者榜上有名
本周一,ICML 2025公布最佳论文奖项,共8篇获奖,含6篇杰出论文奖、2篇杰出立场论文奖,南京大学研究者上榜。大会投稿量持续增长,展示AI领域火热。文中介绍了各获奖论文的研究内容与成果。