「混合推理架构」共找到 3631 篇相关文章
SGLang 推理引擎的技术要点与部署实践|AICon 北京站前瞻
SGLang 是开源推理引擎,截至 2025 年 6 月,在 GitHub 获近 15K Stars,月均下载超 10 万次,被多家行业巨头采纳。InfoQ 专访其核心开发者尹良升,他分享技术、挑战等,6 月 27 - 28 日他将在 AICon 演讲。
VLA统一架构新突破:自回归世界模型引领具身智能
北京智源研究院联合中科院自动化所提出 UniVLA 全新 VLA 模型架构,基于全离散、自回归机制建模多模态信号,后训练引入世界模型。它刷新多项基准纪录,在真机操控和自动驾驶有潜力,为多模态感知决策融合带来新思路。
评论赠书 | CXL抢跑AI算力新战场,未来计算架构激发智算生产力
AI时代传统架构局限性凸显,CXL技术应运而生。它由英特尔等公司联合推出,解决内存鸿沟问题。‘2024 CXL技术创新方案大赛’推动其发展,《CXL体系结构》一书全面介绍该技术。
从数据到决策:AI 驱动的 Quick BI 架构设计与实践
阿里云智能集团瓴羊高级技术专家王璟尧,介绍阿里云 Quick BI 从传统 BI 到 AI 驱动的智能 BI 的进化,解析领域大模型与 BI 引擎协同设计等技术权衡,为行业提供可复用技术范式。
不止于快!美团新推理模型正在重新定义「实用主义AI」
美团发布并开源推理模型 LongCat-Flash-Thinking,它在权威测评表现突出。该模型有多项创新,能更快、更能干、更可靠。其将技术实力转化为业务服务能力,实战测试表现佳,体现美团实用主义 AI 路径。
告别无效计算!新TTS框架拯救19%被埋没答案,推理准确率飙升
现有TTS方法存在路径同质化和中间结果利用不足问题。华为诺亚方舟实验室等机构提出SRCA框架,含检查点注入、答案聚类搜索和检查点候选增强组件,实验显示能提升推理准确性、效率,降低成本。
统一VLA范式!港科大开源StarVLA乐高式架构,复现成本大幅降低
当前具身智能的VLA赛道陷入「碎片化」泥潭,方法难对比、复现成本高。港科大开源StarVLA,提出「乐高式」统一架构,构建模块化开源底座,实现双向模块化,还支持多种训练范式,打通Sim2Real。
彻底告别VE与VAE!商汤硬核重构多模态:砍掉所有中间编码器
商汤科技联合南洋理工大学发布NEO - unify,这是“原生、统一、端到端”多模态模型架构,砍掉VE和VAE,用混合变换器架构打通视觉与语言能力,提升数据与算力利用效率,为跨模态智能系统奠基。
人大高瓴赵鑫团队新作:先拆掉 RLVR,再重建推理模型训练
人大高瓴赵鑫团队围绕RLVR框架做系统实验,完成论文《A3PO: Adaptive Asymmetric Advantage Shaping for Reasoning Models》,提出A3PO方法。该方法将训练重点转向关键决策点,让推理模型学习更可控。
刚刚,OpenAI内部推理模型斩获IOI 2025金牌!所有AI选手中第一
OpenAI内部推理模型获IOI 2025金牌,总排名第6、AI组第1,沿用IMO金牌版本且未专门训练。商业模型在IOI表现不足,Grok 4相对领先。巨头热衷竞赛,源于竞争、技术迭代及多方利益考量。