多GPU性能」共找到 5638 篇相关文章

算法论文7

你永远叫不醒装睡的大模型!轮对话全军覆没,性能暴跌39%

研究人员进行超20万次模拟实验,耗资5000美元,评估大模型在轮对话中的表现。结果显示,大模型在轮对话中性能明显低于单轮对话,平均下降39%,还出现“对话迷失”现象。

新智元
新闻资讯7

刚刚,国产GPU赛道又跑出一个 2700 亿估值独角兽!“中国AMD”沐曦股份完成 IPO,开盘大涨超 500%

2025年12月沐曦登陆科创板,股价达679元/股,估值破2700亿。其定位全栈GPU提供商,产品覆盖领域。2022 - 2024年营收三年复合增长率超4000%,但累计净亏损超30亿。核心团队来自AMD。

InfoQ
推荐文章7

如何为 GPU 提供充足存储:AI 训练中的存储性能与扩展性

文章分析 MLPerf Storage v2.0 测试结果,探讨不同存储系统在 AI 训练中表现。在满足 GPU 利用率阈值下,能支撑更 GPU 的存储系统扩展性与稳定性更强,还需关注资源利用率。以太网存储方案灵活且成本效益高。

AI前线
推荐文章7

智能体自主规划模式性能提升:五大精准策略详解

本文基于智能体React模式实践,剖析自主规划架构挑战,如工具调用延迟等。提出五大优化策略,像用流式XML替代FunctionCall、合理压缩上下文等,还介绍创意加速器AI绘画创作功能,为智能体规划模式提供借鉴。

阿里云开发者
开源动态7

Uno Platform 6.6 发布:Android 启动性能最高提升 61%

Uno Platform 6.6发布,在五平台引入原生AOT发布、可选Vulkan渲染后端等。聚焦运行时性能,提升平台启动速度,还简化XAML编写,增强AI辅助、无障碍及语言支持等。

InfoQ
新闻资讯8

不换GPU性能飙升2.8倍!英伟达用软件暴打摩尔定律

2026年1月8日,英伟达官网披露,基于Blackwell架构的推理软件栈升级,让混合专家模型(MoE)推理效率迎「阶跃式」突破,单GPU吞吐飙升2.8倍,显著降低推理成本。其通过软件针对性升级发挥硬件潜力,还进行项优化。

新智元
产品应用8

Claude Sonnet 4.5发布,领域性能超越GPT-5和Gemini 2.5 Pro

Anthropic发布Claude Sonnet 4.5,是目前最强编程模型,在领域性能超GPT - 5和Gemini 2.5 Pro。操作电脑、数学推理能力提升,产品更新功能丰富,安全性增强,价格不变,获家公司认可。

AI工程化
算法论文8

LoRA中到底有少参数冗余?新研究:砍掉95%都能保持高性能

这篇创新研究介绍了LoRI技术,证明即使大幅减少LoRA的可训练参数,模型性能依然强劲。研究团队在个任务上测试了LoRI,发现仅训练LoRA参数的5%,LoRI就能匹配或超越其他方法的性能

机器之心
新闻资讯7

国产GPU赛道又跑出一个 2700 亿独角兽!“中国AMD”沐曦股份完成IPO,开盘大涨超 500%

继摩尔线程后,沐曦集成电路登陆科创板,截至发稿估值破 2700 亿。其核心团队来自 AMD,产品覆盖领域。虽三年累计净亏超 30 亿,但营收增长强劲。沐曦上市标志国产 GPU 进入“市场与资本检验期”。

AI前线
算法论文8

突破单token预测局限!南洋理工首次将token预测引入微调,编程任务准确率提升11.67%

当前主流大语言模型依赖下一token预测训练,难理解跨token完整概念。南洋理工大学提出概念感知微调(CAFT)技术,首次将token预测引入微调,能让模型理解完整概念,领域实验显示其可显著提升模型性能

量子位