底层架构创新」共找到 2721 篇相关文章

算法论文8

vivo突破手机AI部署难题,绕开MoE架构限制,骁龙8 Elite流畅运行|ICCV 2025

在AI多模态时代,‘让大模型上手机’成焦点。现有MLLM在手机端部署有难题,vivo AI研究院等团队提出GenieBlue方案,绕开MoE架构限制,在骁龙8 Elite芯片手机流畅运行,保持语言性能同时实现多模态表现。

量子位
推荐文章8

OpenAI 早期董事会成员:算法与神经网络成“超能架构”,我们如何自处?|文末赠书

OpenAI 早期投资人里德·霍夫曼新书《AI 赋能》中文版推出。书中提出 AI 应是放大人类行动力的工具,还阐述“超级能动性”概念,强调技术与人类深度共生,批判盲目创新,主张技术锚定人文价值。

AI前线
算法论文8

唯快不破:上海AI Lab 82页综述带你感受LLM高效架构的魅力

大语言模型性能提升但成本高,制约落地应用。上海AI Lab联合多家机构总结440余篇论文,形成82页综述,将LLM高效架构分为7类,探讨最新进展,还涉及线性化技术、硬件实现等内容。

机器之心
7

3个月手搓Gamma架构,这个团队打造出了场景白盒化推理的“下一代内容OS”

AI应用从生成范式转向任务执行范式,Pi团队3个月手搓Gamma架构,打造出场景白盒化推理的“下一代内容OS”。Pi将AI生成与人的编辑能力结合,解决传统创作难题,实现创作全流程系统内闭环。

量子位
算法论文7

中移动九天团队MultiPL-MoE:全新Hybrid-MoE架构用于增强通用大模型低资源代码能力

大语言模型在有限计算资源下提升多语言代码能力面临挑战。中国移动九天团队提出 Hybrid MoE 架构 MultiPL - MoE,耦合两层专家选择机制优化,实验证明其在增强低资源代码能力、缓解高资源语言遗忘上有效。

机器之心
开源动态8

Hermes Agent 技术深度拆解:36000 Star 背后的架构设计,以及你该怎么用它

Hermes Agent 9 个月获 36800 Star,解决记忆断裂、能力天花板和平台绑定问题。它有四层记忆架构、自主技能进化,支持 200+ 模型,还有 40+ 内置工具、15 个平台适配器。最新 v0.8.0 版本有多项更新,文章还给出使用建议和对比。

AI Reading Hub
算法论文8

ICML 2025 Spotlight|华为诺亚提出端侧大模型新架构MoLE,内存搬运代价降低1000倍

华为诺亚和北大研究人员提出端侧大模型新架构MoLE。它解决传统MoE显存开销大、传输延迟高问题,推理时将专家输入改embedding token,用查找表替代矩阵运算,实验显示性能与MoE相当,大幅降推理延迟。

机器之心
新闻资讯8

刚刚,英伟达新模型上线!4B推理狂飙53倍,全新注意力架构超越Mamba 2

Jet - Nemotron是英伟达推出的小模型系列(2B/4B),由全华人团队打造。其提出PostNAS与JetBlock,实现架构优化。相比Qwen3等模型,它在多维度准确率更高,H100 GPU上推理吞吐量最高提升53倍。

新智元
新闻资讯7

创新中心深度支持:20支队伍、300位观众、7小时PK,国内首档AI竞技综艺收官

5月10日,国内首档AI竞技综艺“AI极客争霸赛·奇点市·脑洞嘉年华”在北京收官。20支参赛团队覆盖AI多垂直领域,带来各具特色的脑洞项目,最终《狗眼看世界吧》获冠军。活动由北京AIGC视听产业创新中心等支持。

郎园Station
算法论文8

融资 1200亿后 Kimi 再扔王牌,新架构爆改 Transformer 老配件,比 DeepSeek 同款还省钱

Kimi 发布新论文,提出“注意力残差”架构改进 Transformer 残差连接,解决“稀释问题”,让 AI 更聪明、更省钱,还推出“分块注意力残差”优化成本。与 DeepSeek 方案对比,Kimi 方案性价比更高。

AI前线