算力危机」共找到 877 篇相关文章

算法论文8

打破视觉Token的算力诅咒,RedundancyLens如何为多模态大模型推理减负

多模态大模型的 Decoder - only 架构处理视觉 Token 有计算冗余。合合信息团队提出无需额外训练的动态计算削减方法,在不影响性能前提下降低推理成本,适用于多场景。

PaperAgent
新闻资讯8

100万亿Token看懵硅谷!全球一半算力写代码,另一半在「搞颜色」 ?

OpenRouter和a16z联合发布报告,基于100万亿Token实证数据揭秘2025年AI发展。开源模型流量占比达30%,推理模型成主流,编程和角色扮演是主要使用场景,亚洲付费使用量翻倍,中文成全球第二大交互语言。

新智元
新闻资讯7

评论赠书 | CXL抢跑AI算力新战场,未来计算架构激发智算生产力

AI时代传统架构局限性凸显,CXL技术应运而生。它由英特尔等公司联合推出,解决内存鸿沟问题。‘2024 CXL技术创新方案大赛’推动其发展,《CXL体系结构》一书全面介绍该技术。

芯师爷
新闻资讯8

「美队」老黄深夜扔出地表最强GPU!算力百倍狂飙,下次改演雷神

凌晨,老黄GTC主题演讲华盛顿首秀,亮出下一代GPU核弹Vera Rubin,性能狂飙100倍。目前,Blackwell已全面量产,2026年底两大GPU王牌预计爆赚5000亿美金。此外,英伟达还公布了一系列合作与技术创新。

新智元
算法论文8

研究者警告:强化学习暗藏「策略悬崖」危机,AI对齐的根本性挑战浮现

强化学习是大模型推理与对齐的核心方法,但常带来模型行为脆弱等问题。上海人工智能实验室徐兴成博士论文揭示‘策略悬崖’挑战,分析其成因,解释多种对齐失败现象,并提出对AI研究的启示。

机器之心
推荐文章7

Ropedia刘子纬:具身智能的Scaling Law,不是算力,是人类的经验

Ropedia刘子纬指出,当前物理AI面临差距,下一阶段需Scaling人类物理世界的经验。Ropedia构建真实世界经验引擎,形成经验飞轮,目标是打造能看见、记住、想象并行动的模型。

Founder Park
新闻资讯7

英伟达为何持续押注VASTData?AI存储正在成为新的“算力”|甲子光年

AI产业曾聚焦GPU,如今数据存储设施重要性凸显。VAST Data完成约10亿美元F轮融资,估值300亿美元,英伟达持续跟投。它重构AI数据基础设施,国内焱融科技有相似技术路线且具自主可控优势。

甲子光年
新闻资讯7

谷歌招了一个“全职哲学家”:算力解决不了的难题,交给了文科生

谷歌DeepMind招剑桥学者Henry Shevlin任哲学家,其研究机器意识等。此前DeepMind已布局哲学伦理,Anthropic的Amanda Askell也为Claude写“宪法”,而OpenAI相关团队不稳定,业界对AI本质有分歧。

DeepTech深科技
算法论文8

RL特训出「押题大师」?破解模型微调中的多样性危机与灾难性遗忘

近年来,基于可验证奖励的强化学习(RLVR)成为提升大语言模型推理能力的重要路径,但许多经RL微调的模型出现‘越训越单一’问题。复旦大学等团队聚焦长期被忽视的KL散度项,提出DPH - RL方法,可缓解多样性坍塌。

新智元
新闻资讯8

Nature重磅:智能的尽头是算力!谷歌大佬承认「预测下一个词即智能」

芯片速度触顶,摩尔定律失效,但AI却在疯狂跃迁。Nature文章指出,智能的增长不靠芯片加速,而是结构重组与协作。其核心是预测和并行协作,AI正以类似生命演化的方式发展,与人类相互依存。

新智元