算力瓶颈」共找到 1303 篇相关文章

新闻资讯8

8家国产芯无缝衔接DeepSeek-V4,中国AI算力生态的拐点来了!

4月24日DeepSeek-V4预览版发布,华为昇腾等八家国产AI芯片厂商同日完成全链路适配与性能优化。这得益于FlagOS开源软件栈,也因DeepSeek主动适配策略。后续竞争将转向软件生态完整度。

芯师爷
新闻资讯8

硅谷直击:黄仁勋入局龙虾大战,宣告 SaaS 已死,推理算力需求暴涨万倍!

本文为 CSDN 对英伟达 GTC 2026 大会的现场报道。黄仁勋宣告 SaaS 已死,揭幕 Agent 时代,指出 AI 重心正从训练转向推理,还推出 Vera Rubin、LPX 等新品,强调能效即钱,企业软件将向 Agent-as-a-Service 转变。

AI科技大本营
算法论文8

省下1.25倍算力!Kimi这篇论文,可能改写所有大模型的训练方式

大模型层数增多时,残差连接存在PreNorm稀释问题,导致后面层贡献被稀释。Kimi论文提出Attention Residuals方案,还给出工程解法Block AttnRes,实验显示能省算力且提升效果。

AI寒武纪
算法论文8

首个测试时共进化合成框架TTCS:在「左右互搏」中突破推理瓶颈

厦门大学DeepLIT课题组提出全新测试时课程合成框架TTCS,不依赖外部标注,通过生成器与求解器共进化博弈合成课程数据,解决测试样本过难导致的训练坍塌问题,实验显示其推理能力提升显著。

机器之心
开源动态8

AI4S又一瓶颈被攻克:两个AI「吵架」,让科研代码部署成功率突破95%

科学软件大多难直接运行,制约AI4S与Agentic Science发展。Deploy - Master应运而生,是一站式自动化工作流。Search Agent筛选工具,Build Agent用双模型辩论机制使部署成功率超95%,为科学智能体交互打基础。

量子位
算法论文8

ICML 2025 | 打破残差连接瓶颈,彩云科技&北邮提出MUDDFormer架构让Transformer再进化!

彩云科技与北邮联合提出多路动态稠密连接(MUDD)替代残差连接,提升Transformer跨层信息传递效率。实验显示,采用该架构的模型性能显著提升,论文等均已公开。

机器之心
算法论文8

单GPU搞定高清长视频生成,效率×10!引入Mamba机制突破DiT瓶颈 | 普林斯顿&Meta

普林斯顿大学和Meta联合推出新框架LinGen,以MATE线性复杂度块取代传统自注意力,使单张GPU能在分钟级生成高质量视频。它在视频质量上优于DiT,减少FLOPs和延迟,与先进模型相当。

量子位
开源动态8

突破传统检索瓶颈!阿里通义实验室发布 WebDancer,开启多步推理智能体新范式!

在信息爆炸时代,传统检索技术缺乏动态决策能力,难以满足多步推理需求。阿里通义实验室发布的 WebDancer 基于 ReAct 框架,通过四阶段构建,在测试中表现优异,未来规划拓展工具生态、突破任务边界等。

开源星探
新闻资讯7

性能翻番背后:讯飞与昇腾,如何用国产算力炼就大模型?|甲子光年

在全球AI竞争激烈背景下,科大讯飞与华为昇腾深度合作意义重大。双方合作历经四阶段,实现性能提升与技术突破,还通过软硬件协同构建AI自主发展竞争力,加速大模型行业落地。

甲子光年
新闻资讯7

别再所有人平分AI算力:顶级模型给资深工程师才省钱,新人刷题式成长已失效

在2026世界人工智能大会InfoQ直播间,滕昱和唐飞虎探讨AI Coding深层变化。他们认为AI放大资深工程师能力,冲击新人与大型软件组织,还就模型使用、判断力、企业部署等发表见解。

InfoQ