英伟达GPU」共找到 1450 篇相关文章

新闻资讯7

AI 美妆 ARR 一年增 14 倍 5500 万美金;另一 Newsletter 阅读 App 融了 600 万美金

海外创业者做的 Newsletter 聚合阅读 App Perch 融 600 万美金,可聚合内容,有语音朗读和 AI 摘要功能,还有类似 X 的推荐机制。同时,AI 美妆产品一年 ARR 增 14 倍 5500 万美金。

投资实习所
算法论文8

32B逆袭GPT-5.2:首个端到端GPU编程智能体框架StitchCUDA问世

现有LLM自动化CUDA方法难处理端到端GPU程序,StitchCUDA提出多智能体框架+基于Rubric Reward的Agentic RL方案,分解任务、优化训练,在实验中成功率和加速比远超其他方法,解决Reward Hacking问题。

机器之心
新闻资讯8

黄仁勋2026大模型座上宾:杨植麟

英伟2026年GTC大会嘉宾中,杨植麟是唯一来自独立大模型创业公司的代表。过往黄仁勋邀人有“风口预言术”,此次选杨植麟,或因他搞出K2.5、死磕推理效率,能给英伟讲新故事。

量子位
开源动态8

装机量超2000万、全球主流GPU与AI框架“开箱即用”!OpenCloudOS成AI时代优先选项

在大模型训练迭代快、算力需求高但 GPU 利用率低、生态碎片化的背景下,2025 OpenCloudOS 操作系统生态大会举办。OpenCloudOS 围绕 AI 升级技术,构建能力闭环,还发布智能基座,降低产业链技术摩擦。

InfoQ
新闻资讯8

GPT-6 Astra 正式登场:烧了 10 万块 GPU、多项跑分逼近满分,OpenAI 总裁:我们迎来 AGI 时代

今天凌晨,OpenAI正式发布GPT - 6 Astra。它多项跑分逼近满分,OpenAI总裁称其或意味着AGI时代开始。该模型在多方面能力领先,安全措施升级,将在‘未来几天’面向部分用户推出。

AI前线
产品应用7

【CUDA 博客】TMA简介 & 让矩阵转置在Hopper GPUs上变得更快

文章介绍Hopper GPU新特性TMA,它能高效传输多维数组数据。文中展示用TMA对2D数组操作,如创建张量映射、编写kernel等。还讲了避免共享内存bank冲突的交织方法,最后介绍在Hopper GPU上实现高效矩阵转置的多种方式及性能。

GiantPandaLLM
新闻资讯7

CS专业爆冷,失业率艺术史2倍!年入千万只需5年,大学却在禁Cursor

在AI浪潮下,CS专业情况两极分化,25岁辍学生用不到2年打造百亿美金Cursor,而CS毕业生失业率艺术史2倍。美国创业机构YC举办圆桌讨论,探讨AI时代职业选择、学校价值等问题。

新智元
算法论文8

全新GPU高速互联设计,为大模型训练降本增效!北大/阶跃/曦智提出新一代高带宽域架构

随着大模型参数规模扩大,分布式训练成关键路径,高带宽域设计对提升训练效率至关重要。现有HBD架构在可扩展性、成本和容错能力等方面有局限,北大、阶跃、曦智团队提出InfiniteHBD架构解决问题。

量子位
新闻资讯8

老黄在CES 2026 上预言:将要告别应用软件的预编译时代,未来的应用是 GPU 上实时生成每一个像素

黄仁勋在CES 2026预言,应用将告别预编译时代,在GPU上实时生成像素。他回顾2025年AI关键进展,介绍Agentic AI特点与能力,还谈了其搭建及应用前景,指出未来软件或基于Agent交互。

宝玉AI
算法论文8

ICLR 2026!代码优化不再靠玄学:大模型真正学会“又快又准”,效率提升71.06%,加速比6.08x

ICLR 2026顶会文章提出全新大模型代码优化方案,切入代码优化核心难题。该方案将代码优化率提至71.06%,加速比6.08x,正确性提至74.54%,有很强工程可用性。

AINLPer