大推理模型」共找到 9483 篇相关文章

算法论文8

同时监督和强化的单阶段模型微调,告别“先背书再刷题”,推理泛化双提升|中科院&美团等

中国科学院自动化研究所联合美团提出单阶段监督 - 强化微调方法 SRFT,结合监督微调与强化微调,解决传统两阶段方法的不足,在多任务中提升推理和泛化能力。

量子位
开源动态8

狂揽22.6k星!这个开源工具让你一键调用100+模型,开发效率直接起飞!

LiteLLM是BerriAI团队开发的开源工具,通过标准化OpenAI格式API接口,能无缝调用100+主流语言模型。有核心功能亮点,适用于多场景,还给出上手步骤,并与同类项目对比。

小华同学ai
开源动态8

小红书发布FireRedChat:首个可私有化部署的全双工模型语音交互系统

小红书智创音频团队推出业内首个支持私有化部署的全双工模型语音交互系统FireRedChat,可将半双工链路升级为全双工,提供级联与半级联服务,在多指标领先,让AI有“人感”。

机器之心
新闻资讯8

推理成本太高、算力不够用?单纯堆卡没用,得靠极致的“压缩”与“调度” | AICon

模型落地面临推理成本高、算力需求的问题。AICon会上,阿里云刘峥、ModelTC龚睿昊、阿里巴巴马腾、OPPO宋晓辉、清程极智汤雄超等专家将分享从压缩到调度的推理优化方案,覆盖云到边缘、多算力平台。

InfoQ
开源动态8

Token洪流的转向:当AI Agent成为Token消耗的主宰,什么样的推理服务基础设施才是刚需

Token消耗量转移,AI Agent成Token消耗主宰,模型推理服务底层逻辑重塑。文章介绍AI Agent时代范式转变、对推理基础设施的需求,还阐述了为其打造的AI Serving Stack架构及优势,它获2025年度相关卓越奖。

AI前线
算法论文8

定位模型「作弊」神经回路!新研究首次揭示:虚假奖励如何精准激活第18-20层记忆

此前学术界发现模型用虚假奖励训练也能提升准确率,背后微观机制是黑盒。南科等团队深度拆解,定位到关键记忆节点,发现‘困惑度悖论’,还能操控记忆,成果对评估、检测和去污染有意义。

量子位
推荐文章8

硬核拆解模型,从 DeepSeek-V3 到 Kimi K2 ,一文看懂 LLM 主流架构

本文详细列举 8 个主流语言模型,硬核拆解架构设计与革新思路,介绍架构演进趋势。如 DeepSeek-V3 的 MLA 与 MoE 技术,OLMo 2 的归一化策略,Gemma 3 的滑动窗口注意力机制等。

机器之心
算法论文8

ACL 2026 综述:从事后解释到内生解释,模型内生可解释性的前沿进展

语言模型但解释性成问题,过去多事后解释,现更多研究者转向内生可解释性。ACL 2026 接收的综述论文梳理相关代表方法,总结为五类核心设计范式,指出该方向面临挑战但趋势清晰。

机器之心
开源动态8

蚂蚁Ring-1T正式登场,万亿参数思考模型,数学能力对标IMO银牌

10月14日凌晨,蚂蚁万亿级思考模型Ring-1T正式登场,这是全球首个开源的万亿参数思考模型。它在多项基准测试中表现出色,数学能力达IMO银牌水平,还展示了强的代码、推理、写作等能力,其背后是IcePop算法与ASystem框架的支撑。

机器之心
新闻资讯7

全球首个 IPO 模型公司出现!智谱携 500 亿估值开启招股、70% 募资投研发,1 月 8 日登陆港股

12月30日,智谱华章启动港股IPO招股,预计1月5日结束,1月8日挂牌。以每股116.20港元计,募资约43亿港元,市值超511亿港元。70%募资用于模型研发,还引入多家基石投资者。

InfoQ