降本」共找到 583 篇相关文章

算法论文8

全新GPU高速互联设计,为大模型训练降本增效!北大/阶跃/曦智提出新一代高带宽域架构

随着大模型参数规模扩大,分布式训练成关键路径,高带宽域设计对提升训练效率至关重要。现有HBD架构在可扩展性、成和容错能力等方面有局限,北大、阶跃、曦智团队提出InfiniteHBD架构解决问题。

量子位
产品应用8

国产算力Day 0适配,一人剧组时代到来,商汤Seko 2.0降本增效让AI短剧真正落地

商汤Seko 2.0率先实现创编一体与多剧集智能生成,通过一致性控制技术与国产算力适配,缩短漫剧制作周期。它解决了AI视频生成痛点,低成、提升效率,适配国产芯片,还拓展了内容生态。

AIGC开放社区
新闻资讯8

黄仁勋CES放出大杀器:下一代Rubin架构推理成10倍

在CES 2026展上,英伟达黄仁勋介绍多项进展。下一代Rubin平台含六款芯片,推理成10倍;发布Alpamayo 1开源模型助力自动驾驶;还推出物理AI新模型等,携手伙伴展示机器人。

机器之心
产品应用8

硬件成60%!原生分布式VS传统分库分表数据库

服务器硬件价格上涨,传统分库分表架构资源利用效率低。OceanBase 作为原生分布式数据库,通过多种技术优化资源,低硬件依赖,多个案例显示其能大幅低成、提升性能,获 Forrester 认证。

InfoQ
产品应用8

全网首测!首款国产GPU「AI算力」现场上手

新智元报道首款国产GPU「AI算力」MTT AIBOOK,它搭载国产全功能显卡,预装开发环境,打破系统壁垒。其背后的MUSA架构全栈自研,软件升级、有翻译工具,硬件架构革新,还有开源计划,产品应用广泛。

新智元
产品应用8

一行代码,Claude成85%!最强Opus做大脑,Sonnet疯狂搬砖

Anthropic深夜发布Claude「顾问策略」,让Opus 4.6当「顾问」,Sonnet/Haiku当「执行者」,实测性能翻倍、成85%。还带来Monitor工具更新,加上此前的Managed Agents等,构建完整Agent平台。

新智元
算法论文8

首次披露!DeepSeek V3 发布软硬一体协同训练论文,公开「」秘诀

DeepSeek团队发布论文《洞察DeepSeek - V3:规模的挑战和对AI架构硬件的思考》,从硬件架构和模型设计双重视角,探索其经济高效的大规模训练和推理方法,介绍了设计原则、低精度驱动等多方面内容及秘诀。

AI科技评论
算法论文8

清华刘知远团队:高质量LLM训练数据获取新方法!成90%,性能大提升

清华刘知远团队论文提出全新数据筛选方案,解决传统数据筛选验证慢、主观性强问题。发明‘半成品加工法’,用fastText筛数据,筛出Ultra - FineWeb数据集,提升模型性能,还计划拓展到专业领域。

深度学习自然语言处理
算法论文8

全新线性注意力范式!哈工深张正团队提出模长感知线性注意力!显存直92.3%!

哈工深张正团队联合多团队发布论文,提出 NaLaFormer 框架,解决线性注意力两大核心缺陷,保持线性复杂度同时精度超越,在多任务表现出色,如超分任务显存 92.3%。

机器之心
新闻资讯7

AI 能耗救星!这个能倒着走的「可逆计算」芯片,将能耗直10倍

最新研究提出可逆芯片,通过让计算「倒着走」,有望将AI能耗直10倍。它基于热力学原理,避免删除数据以减少热量产生。经几十年探索,如今可逆计算或成延续计算进步关键。

AGI Hunt