芯片效率」共找到 1798 篇相关文章

算法论文8

大模型能力,小模型成本!Google等 | 提出递归混合框架:MoR, 大幅提升LLM计算效率

Google提出递归混合框架(MoR),融合参数共享与自适应计算。它有轻量级路由和KV缓存策略,在不同路由机制各有优劣。实验显示,MoR在性能、计算和内存效率上表现出色,有望实现“大模型能力,小模型成本”。

AINLPer
新闻资讯8

“不必给中国最新最好芯片!”黄仁勋直言不同意Dario做法,称“软件工程师岗没了”完全没道理!

英伟达创始人黄仁勋在与CNBC Cures联合创始人Becky Quick对话中,谈到芯片出口、投资、AI安全、就业等问题。他认为美国公司应全球竞争,出口能强化国家安全;开源是应对网络安全的答案;AI创造就业,软件工程师岗位在增加。

AI前线
推荐文章8

万字长文 | 异构算力技术架构与核心组件解析

文章聚焦异构算力技术架构与核心组件,解析主流AI芯片特点、国产芯片技术路线;介绍高速互联技术、网络拓扑结构及优化方法;阐述大模型存储需求、分布式存储技术及数据预处理与加载技术,为AI计算提供全面方案。

AIGC开放社区
产品应用8

最高能效比!他又死磕“存算一体”2年,拿出全新端边大模型AI芯片

后摩智能CEO吴强在今年WAIC期间发布业界能效比最高的存算一体端边大模型AI芯片后摩漫界®M50。它搭载第二代存算一体技术,全栈自研实现软硬件协同优化,还配套系列产品,构建端边智能新生态。

量子位
新闻资讯7

高通新款云端芯片公开!借推理抢英伟达蛋糕,市值一夜暴涨197.4亿美元

高通宣布推出AI200和AI250两款全新AI芯片进军数据中心市场,消息使股价一度飙升超20%。新品聚焦推理阶段,主打低TCO、高能效与强内存处理能力,还推进端到端软件栈。高通早有布局,已获订单。

量子位
算法论文8

Meta提出Deep Think with Confidence:几乎啥都不用动,就能提升推理的准确性与效率

传统自一致性方法虽能提升推理准确率,但计算开销大、收益递减。Meta AI与UCSD团队提出Deep Think with Confidence(DeepConf),可在不增训练成本和不调超参数下,提升推理准确性与效率,本文对其全面解读。

深度学习自然语言处理
开源动态8

美团杀入视频生成模型赛道,LongCat-Video 136亿参数媲美顶尖模型,效率提升10倍

美团LongCat团队发布LongCat - Video基础视频生成模型,有136亿参数量,多任务表现出色。它核心亮点多,还建立了数据处理流水线,采用特殊架构和训练方法,提升了生成效率,性能媲美顶尖模型。

AIGC开放社区
新闻资讯7

GPT-5.4一周狂赚10亿美元ARR!一句嗨烧掉80刀,效率却飙升32倍

OpenAI总裁披露,GPT - 5.4上线一周,每天处理约5万亿token,带来10亿美元年化净新增收入。它成本和token消耗量高,但效率提升32倍。作为“大一统”模型,它智能水平出色,原生支持电脑操作。

量子位
产品应用8

打破56年数学铁律!谷歌AlphaEvolve自我进化实现算法效率狂飙,堪比AlphaGo“神之一手”

谷歌DeepMind联合顶尖科学家打造「通用科学人工智能」AlphaEvolve,打破矩阵乘法领域56年效率基准,将4x4矩阵乘法标量乘法次数从49次降至48次,还在谷歌内部加速了运算、缩短训练时间。文中介绍其原理与技术。

量子位
新闻资讯7

黄仁勋现身深圳参加年会:没抽红包、没谈芯片、没邀外部企业|甲子光年

1月28日晚,英伟达创始人黄仁勋现身深圳年会。他发言简短,未提芯片进展,抽奖无万元红包,也未邀外部企业。此次来华他在产品业务上低调,或因出口管制,不过私下更“接地气”。

甲子光年