「高带宽存储器」共找到 1901 篇相关文章
27亿美元天价回归!谷歌最贵「叛徒」、Transformer作者揭秘AGI下一步
在Hot Chips 2025上,Transformer发明者之一、谷歌Gemini联合负责人Noam Shazeer指出LLM发展需更多算力、内存等硬件支持。微软AI的CEO Mustafa Suleyman预测2026年底前LLM或成“行动型AI”,还提及失业潮等问题。
7亿人每周狂发180亿条消息!OpenAI首次揭秘ChatGPT最火用途
OpenAI联合杜克、哈佛发布ChatGPT首份使用报告,显示周月活达7亿,成高学历白领办公利器,编程冷门。同时,Anthropic报告称人们交给Claude完成任务比例涨至49%,Claude主战场是代码编写。
别让Nano Banana骗了!混合方案让头像生成成功率从0到100%
作者用Nano banana更新头像时发现其生成中文能力差,提出将AI画图与HTML编程结合的方案。HTML搞定确定性、成本低部分,AI画图负责复杂、创意性高部分,还给出使用方法及多种头像加字设计方案。
腾讯开源WMT2025冠军大模型:拿下30个第一,同类最佳
昨晚腾讯开源WMT2025冠军翻译大模型Hunyuan - MT - 7B,它在31种语言测试中获30个第一,成同类最佳。文中介绍其架构、训练过程,还通过多场景翻译案例展现优势,有望推动高质量翻译普及。
0 融资、10 亿美元营收,数据标注领域真正的巨头,不认为合成数据是未来
Surge AI创始人Edwin Chen接受访谈,提出创业应解决问题而非融资,合成数据被高估,高质量数据才是壁垒。他还指出大语言模型竞技场误导训练方向,人类反馈永不过时,数据质量是AI发展首要瓶颈。
SGLang Team:在 96 个 H100 GPU 上部署具有 PD 分解和大规模专家并行性的 DeepSeek
本文介绍 SGLang 团队在 96 个 H100 GPU 上部署 DeepSeek 的方法。利用 PD 分解和大规模专家并行性,SGLang 实现高吞吐量,成本低。博客探讨并行设计、优化方法,所有组件开源,也指出了当前局限与未来方向。
DeepMind:Transformer存在拓扑缺陷,思维链治标不治本
谷歌DeepMind论文指出,Transformer架构不擅长追踪状态,思维链只是给结构性缺陷打补丁,成本高。论文主张用循环架构替代或补充纯前馈结构,还提出多个研究方向,认为下一代模型需构建‘流动的现实表示’。
刚刚,马斯克发布Grok-4,在各大基准测试上表现太猛了。
马斯克的 xAI 发布 Grok - 4,在各大基准测试表现出色,如 AIME25 拿满分、GPQA 领先等。第三方测评显示其登顶,编码和数学指数居首。价格与 Grok 3 相同,今日上线但价格高,甚至有已售罄情况。
宇树上市:王兴兴的十年非共识|甲子光年
2026年宇树科技成功上市,创始人王兴兴创业十年有诸多“非共识”观点。如高性能机器人不意味昂贵,堆数据难带来具身智能,AI强对硬件要求或降低。如今宇树成行业共识,也面临新挑战。
M2模型杀回Coding和Agent领域,MiniMax想要「普惠智能」
如今大模型竞争转向综合比拼,MiniMax 发布并开源 M2 模型,在权威测评跻身全球第一梯队。它定位轻量级,Coding 与 Agentic 能力强,性价比高,还升级 Agent 产品,以技术普惠策略让用户零成本体验。