多GPU性能」共找到 5673 篇相关文章

产品应用7

飞猪搭建系统演进:从人工运营到Agent协同搭投生产

飞猪移动端页面搭建体系从初代寄生于阿里集团平台,发展成“搭投”体系。但传统人工选搭投模式待优化,为此启动AI智能搭投升级专项,构建新范式,还介绍产品结构、技术实现及后续规划。

InfoQ
算法论文7

Agentic-KGR:通过智能体强化学习实现知识图谱的协同演化

文章指出静态知识库有覆盖缺失、时效滞后、建用分离问题。介绍 Agentic - KGR 创新点,如动态 schema 扩展等。实验显示其在图谱抽取和下游 QA 任务有提升,还呈现训练动态和图谱质量可视化结果。

PaperAgent
新闻资讯8

大模型上天、马斯克发射GPU?中国团队直接建「太空超算」

2025年11月,英伟达送H100入太空,谷歌计划2027年发射81颗搭载TPU的卫星。美国欲打造太空生态闭环,中国中科天算等团队也在行动,中科天算目标是在太空建超算中心。

新智元
新闻资讯8

马斯克用恐怖算力,堆出6万亿参数性能怪兽Grok 5!剑指AGI

马斯克以Grok为核心推进xAI,从算力、数据到产品生态全面布局通往AGI的道路。Grok迭代迅速,有独特研发哲学。X平台数据、特斯拉算力成资源护城河,Grok还将进入特斯拉汽车。但Grok成长中也有争议,xAI在探索中前行。

新智元
开源动态8

开源!强效果,高性能,严隐私?我全都要:OPPO 终端大模型实践

OPPO AI 中心推出开源端侧模态大模型 AndesVL,含 0.6B - 4B 四档尺寸套件,有通用能力强等优势。它经阶段训练,OPPO 还构建端侧部署方案,评测显示其在方面表现优异,未来会继续技术革新。

InfoQ
新闻资讯7

FlashAttention-4震撼来袭,原生支持Blackwell GPU,英伟达的护城河更深了?

在 Hot Chips 2025 上,TogetherAI 首席科学家 Tri Dao 公布 FlashAttention-4,其在 Backwell 上比英伟达 cuDNN 库中的注意力核实现快 22%,还实现两项算法改进。该技术一直迭代升级,提升了注意力计算效率。

机器之心
新闻资讯7

OpenAI最强对手出现!马斯克发布Grok-4,性能碾压Claude 4两倍!

半小时前马斯克发布Grok - 4,虽Grok3.5跳票、直播迟到被吐槽,但它训练量和算力投入大。在项基准测试中碾压Claude Opus 4,还具备原生工具调用等能力,xAI目标是让其更快更智能。

探索AGI
开源动态7

DeepSeek研究员1200行代码复刻vLLM,H800硬件实测性能反超原版

DeepSeek研究员俞星凯搞出开源项目Nano - vLLM,仅用不到1200行代码实现最小化且完全可读的vLLM。它有快速离线推理、代码可读性强、含优化套件等特点,在H800硬件实测中性能反超原版vLLM。

量子位
算法论文7

奖励是假的,能让Qwen提升25%性能却是真的!

华盛顿大学博士生团队用Qwen模型对虚假奖励进行RLVR,使MATH - 500准确率显著提升约25%。研究发现RLVR不考虑奖励正确性,还分析了虚假奖励有效的原因,提示现有研究要在非Qwen模型验证。

量子位
新闻资讯7

GPU开始金融化!黄仁勋拉上华尔街搞5000亿美元融资,回应“循环投资”

黄仁勋宣布NVIDIA与家金融机构合作,建立融资平台,撬动超5000亿美元第三方资本建设AI基础设施。他推出AI工厂概念,称算力能成可投资资产,还回应了循环投资质疑。

量子位