高性能计算」共找到 3854 篇相关文章

算法论文7

1/3预算跑平 GPT-5?上海AI Lab「路由魔法」成本直降63%性能反涨 7%!

当前大模型需解决性能与效率平衡问题,GPT - 5用测试时路由技术初步平衡。Avengers - Pro测试时路由框架集成不同LLMs,通过嵌入、聚类、评分操作,调整权衡参数α,能依查询特征选模型,性能和效率优于单一模型。

CourseAI
推荐文章7

关于现代GPU体系结构内存一致性(Memory Consistency)模型的一些猜想(二)——同步性能

文章聚焦GPU应用层面,通过实验对比不同同步代码实现的性能。在H20 GPU上测试,发现scope越小同步性能越好,内存屏障开销随scope增大而增加,还介绍非PTX及官方推荐实现方式并给出性能对比。

GiantPandaLLM
产品应用7

OpenAI浏览器换壳杀回!管改用ChatGPT上网,效率从未这么

Atlas关停不到一个月换壳回归,核心管Tibo称ChatGPT桌面版成主力浏览器,效率极。这源于OpenAI把浏览能力融入ChatGPT。它不再执着造独立浏览器,而是围着Chrome,争用户数字身份。

新智元
开源动态7

如何重现 DeepSeek 推理性能突破

DeepSeek-V3 是热门开源大模型,采用大规模 MoE 架构,优化推理性能是工程难点。阿里团队在 RTP - LLM 完成优化,对齐其推理系统性能,分享关键技术、不足与思考,还提及对 Qwen3 模型的优化策略。

InfoQ
新闻资讯8

OpenAI 3000亿美元大单!甲骨文股价一夜飙升35%

OpenAI与甲骨文官宣签下3000亿美元云计算合同,消息一出甲骨文股价飙升35%。这笔交易刷新云计算领域记录,其将助力OpenAI的“Stargate”计划,虽能耗,但也会带来经济回报,还改变了云计算市场格局。

AIGC开放社区
新闻资讯7

新的 Rust 客户端致力于实现基于 Aerospike 的安全、性能应用

Aerospike正式发布Rust客户端,用于与其实时NoSQL数据库交互。采用异步优先并发模型,支持批命令等。还将支持分区查询等功能,Aerospike也提供其他客户端库助开发者构建应用。

InfoQ
算法论文7

视觉优势还是语义依赖?揭秘 DeepSeek-OCR 压缩率背后的真相

中科院等团队论文剖析 DeepSeek - OCR,通过实验揭示其压缩率下准确率或依赖语言先验。去掉语言先验,准确率暴跌;下游任务推理崩塌,长文本处理也有瓶颈。

深度学习自然语言处理
开源动态8

刚刚,美团开源 SOTA 推理模型 LongCat-Flash-Thinking,性能逼近 GPT5-Thinking

美团宣布开源效推理模型 LongCat-Flash-Thinking,性能逼近 GPT5-Thinking,是国内首个结合多种推理能力的大语言模型。它采用新方法提升性能,已在多平台开源,API 平台免费开放,还兼容主流 API 格式。

AGI Hunt
新闻资讯7

AMD发布旗舰AI芯片,称性能比肩英伟达

当地时间6月12日,AMD CEO苏姿丰在大会展示多款AI新品,将新AI芯片与英伟达同类产品对比,称性能比肩且性价比。还展示了新软件栈、介绍下一代AI机架产品,预计推理成未来AI发展主驱动力。

芯师爷
算法论文7

一句话,性能暴涨49%!马里兰MIT等力作:Prompt才是大模型终极武器

马里兰大学、MIT、斯坦福等机构研究发现,AI性能提升一半靠模型,一半靠提示词。他们让DALL - E 2和DALL - E 3 PK,发现DALL - E 3性能提升中,模型升级贡献51%,提示词优化贡献49%。

新智元