「混合推理方案」共找到 2919 篇相关文章
均值至上假繁荣!北大新作专挑难题,逼出AI模型真本事
当强化学习成大模型后训练核心工具,主流方法陷入「均值优化陷阱」,推理能力停滞。北大团队提出RiskPO,将风险规避理念融入优化目标,用MVaR+捆绑策略双管齐下,三大任务表现优异。
大模型虽好,但恕我直言:在OCR面前,开源小模型更香
作者所在公司项目需处理大量纸质文档,起初考虑云端大模型API调用和开源大模型本地化部署,却因成本高、硬件要求高受阻。后经推荐调研PaddleOCR,其功能全、成本低、易用性强,最终被选为项目核心方案。
Transformers来到了v5时代:从工具包到真理之源,AI时代的操作系统内核的极简进化论
Transformers v5发布,通过极简定义和极致互通成AI生态核心。它做减法重构代码、拓展训练流程、成推理引擎弹药库、提升量化为核心功能,连接训练、推理与部署,是AI生态通用语言。
小红书提出DeepEyesV2,从“看图思考”到“工具协同”,探索多模态智能新维度
小红书推出多模态模型DeepEyesV2,它延续视觉推理优势,实现代码执行、网页搜索和图像操作的全工具协同。通过多工具协同推理解决复杂问题,采用两阶段训练策略,准确率远超开源模型。
LLM的快速、慢速与工具增强思维模式综述
大型语言模型在不同任务中对推理策略需求差异大,策略选择不当会影响效率与可靠性。本文提出双重知识边界框架,梳理LLMs推理模式,将策略选择形式化,还分析了决策因素及策略选择机制。
就是阻击OpenAI,Claude抢先数十分钟发布Claude Opus 4.1
就在Sam Altman官宣两个开源推理模型前半小时,Anthropic抢先发布新模型Claude Opus 4.1。该模型能力提升,适用多平台,定价公布,企业用户反馈良好,还提供混合推理模式,不过订阅费遭吐槽。
ACL 2025|为什么你设计的 Prompt 会成功?新理论揭示大模型 Prompt 设计的奥秘与效能
英属哥伦比亚大学等团队剖析Prompt在LLM的CoT推理中调控模型内部信息流,构建量化Prompt搜索空间复杂度理论框架。研究解释提示有效的原因,提供设计高效提示词思路,实验验证理论框架。
谷歌Ironwood架构TPU v7:用AI造AI,撼动英伟达芯片帝国
11月25日谷歌云发布第七代定制芯片Ironwood,由AlphaChip设计。它以9.6 Tb/s光互联带宽和1.77 PB共享显存池重构大模型推理硬件基准,挑战英伟达芯片地位,展现AI算力竞争新趋势。
可复制的 AI Coding 全栈实战:比 OpenSpec 更轻量、更丝滑
本文整理自淘宝闪购邓立山在 QCon2026 北京站演讲,分享其团队一年多 AI 编码全栈实战经验,分析 AI 编码问题,提出解决方案,介绍方案演进、实战案例及推广情况,还探讨了未来演进方向。
Claude翻车:Opus 4.1白天退化,Anthropic承认并回滚更新
发布即拿下各项SOTA的Claude Opus 4.1翻车,用户反馈其变得迟钝,官方承认处理某些请求时质量退化,如白天推理性能下降,使用限制不明确,还会暴露API密钥,官方已回滚版本。