计算资源报告表」共找到 1290 篇相关文章

开源动态7

推理成本骤降75%!gpt-oss用新数据类型实现4倍推理速度,80GB显卡能跑1200亿参数大模型

OpenAI在gpt - oss开源模型采用MXFP4数据类型,使推理成本降75%,内存占用为BF16模型四分之一,生成token速度提4倍,还能降低硬件资源需求。不过MXFP4也有缺陷,英伟达推出NVFP4提升质量。

量子位
算法论文8

扩散模型+自进化:这篇论文让Deep Researcher错误率直降70%

论文提出测试时扩散深度研究代理(TTD-DR),将告生成建模为扩散过程,有组件自进化机制和动态闭环设计。实验显示其在多领域研究任务超现有方案,为AI研究助手落地提供新范式。

深度学习自然语言处理
产品应用8

全新 AI 消息模型:Apache RocketMQ 如何让 AI 应用拥抱事件驱动架构?

AIGC浪潮下,大语言模型重塑应用开发范式,开发者构建AI应用面临诸多挑战,需可靠高效的异步通信机制。Apache RocketMQ在AI时代演进,有轻量化通信与智能化资源调度两大创新,还介绍了多场景实践。

InfoQ
新闻资讯7

穿上唐装,黄仁勋在急什么?

北京时间7月16日,黄仁勋穿唐装在「链博会」演讲。此前英伟达H20芯片获出口资格,RTX Pro芯片将在华发售。他与雷军聊AI和小米汽车,谈H20芯片、Meta抢人等话题,还称财务自由无梦想。

芯师爷
推荐文章7

【博客转载】CUDA Local Memory

文章围绕CUDA本地内存展开,介绍其为线程私有存储空间,访问特性与全局内存类似。通过两个计算滑动平均值的CUDA kernel示例,展示数组索引复杂度对存储位置的影响,还给出判断存储位置的方法及优化建议。

GiantPandaLLM
算法论文8

无损减少80%激活值内存,提升5倍训练序列长度,仅需两行代码

港中文(深圳)和上海交通大学团队提出 StreamBP 算法,通过线性分解和分步计算,将大语言模型训练激活值内存降至梯度检查点的 20%,在相同内存下最大序列长度为其 2.8 - 5.5 倍,代码已开源。

机器之心
开源动态7

20人团队提前实现DeepSeek构想,AI算力变天?直击大模型算力成本痛点

国内20人玉盘AI团队推出SRDA全新计算架构方案,试图从硬件源头解决当前AI算力核心瓶颈。该架构有诸多创新设计,能应对大模型训推痛点,与DeepSeek构想契合,或成大模型专用架构分水岭。

新智元
新闻资讯7

Replit 怒锤“欧洲版 Cursor”:造出百款“高危”应用,普通开发者一小时内黑入,氛围编码成了黑客“天堂”?

近日,Replit员工告“欧洲版Cursor”Lovable有安全漏洞,虽早收到通却未修复。员工扫描其1645款应用,170款可让人访问用户信息。多位工程师成功“黑入”,Lovable虽有改进但仍未解决底层问题。

AI前线
开源动态8

Agent 框架热潮褪去,大模型开发已经进入“生死局”?

蚂蚁开源发布《2025 ⼤模型开源开发⽣态全景与趋势》告,涵盖 19 个技术领域 135 个项目,解读七大趋势。当下大模型开发生态如黑客松,项目兴衰快速,AI Search 式微、AI Coding 火热,三大技术领域也有变化。

AI前线
新闻资讯7

大模型下半场,阶跃凭什么领跑多模态之战

国内大模型竞争分资源派、技术派、国家队三阵营,多模态成竞争分水岭。阶跃星辰成立两年发22款自研基座模型,16款为多模态。其坚持理解生成一体化路线,在多模态领域有优势,还布局多应用场景。

AI科技评论