大模型架构」共找到 9819 篇相关文章

产品应用7

企业软件底层逻辑脱胎换骨:从席位订阅到决策订阅,下一个万亿公司属于这类玩家

模型落地进入深水区,企业级软件底层逻辑发生“脱胎换骨”变化。以特赞提出的GEA架构为例,企业软件竞争从模型能力转向认知结构,价值结构、引力中心等都在改变,软件订阅也从席位转向决策。

量子位
算法论文8

ICLR 2026|在「想象」中进化的机器人:港科×字节跳动Seed提出WMPO,在世界模型中进行VLA强化学习

香港科技学 PEI - Lab 与字节跳动 Seed 团队提出 WMPO 新范式,可让具身智能在‘想象中训练’,解决传统 VLA 训练瓶颈,目前论文、代码与模型均已开源。

机器之心
产品应用8

刚刚,Qwen3.8-Flash震撼发布,我们看到了Qwen4的骨架

8月模型厂商多上调API价格或收缩免费额度,因推理需求增长跑赢算力供给。阿里发布Qwen3.8-Flash并开源,成绩亮眼且价格低。它是Qwen4架构预演,有四技术创新,提升了模型效率。

机器之心
新闻资讯8

李飞飞LeCun疯狂加注!这匹中国黑马,已在因果AI暗战6年

世界模型成AI核心战场,背后是行业向因果科学转向。多数人2026年关注“因果”,中国零犀科技早在2020年就探索因果AI,自研因果模型,搭建工程架构,将能力融入业务体系,提前布局优势凸显。

新智元
开源动态8

罗福莉携小米MiMo-V2-Flash首次亮相:一次在推理与Agent上的下注|甲子光年

模型进入新阶段,效率成能力一部分。小米MiMo团队12月16日晚发布并开源MiMo - V2 - Flash,负责人罗福莉首亮相。该模型在推理、编程和智能体场景表现出色,在架构、训练方法等有创新。

甲子光年
算法论文8

颜水成领衔,给AI分段位!超100款多模态模型,无人达到L5

十所顶尖高校联合发布General - Level评估框架和General - Bench基准数据集,用五级分类制明确多模态通才模型能力标准。评估超100款模型,发现多数在L2 - L3,无L5模型,揭示当前模型不足。

新智元
算法论文8

ICLR 2026 Oral|模型总爱「想太多」? DECS从源头消除冗余思考,实现推理token减半且性能不降反升

以DeepSeek - R1等为代表的型推理模型存在过度思考问题,造成量冗余计算。复旦学等团队在ICLR 2026 Oral论文中揭示‘长度惩罚’局限性,提出DECS框架,在多基准测试中实现推理长度减半且性能提升。

机器之心
算法论文7

上交和辉羲把LLM刻进ROM!推理性能冲2万token/s,GPU时代终结?

硅谷Taalas将模型‘物理焊死’进芯片引关注,而上海交、辉羲智能与微软亚洲研究院团队用ROM+SRAM异构架构,将端侧LLM推理速度推至20,000 tokens/s。介绍了ROMA和TOM架构优势及应用场景。

新智元
新闻资讯7

龙虾惨遭卸载,OpenAI 最新博客:Agent 的安全隐患,可能永远无解

OpenAI 博客指出 AI Agent 安全隐患或无解。三 AI 巨头投入防御,仍难抵攻击,如 OpenClaw 就出现多起安全事故。其根源是语言模型架构缺陷,不过‘不可解’不等于‘不可控’,业界已有应对策略。

AGI Hunt
开源动态8

视频理解新标杆,快手多模态推理模型开源:128k上下文+0.1秒级视频定位+跨模态推理

快手开源能看懂视频并跨模态推理的模型Keye-VL 1.5,其有时序定位、描述和推理能力,跑分领先。采用三段式架构和Slow-Fast编码策略,经四阶段预训练和多阶段后处理,团队成果多,推动多模态技术落地。

量子位