「计算芯片」共找到 1230 篇相关文章
“最强编码模型”上线,Claude 核心工程师独家爆料:年底可全天候工作,DeepSeek不算前沿
Anthropic 开发者大会发布 Claude 4 ,含 Opus 4 和 Sonnet 4 型号,在基准测试表现出色。核心工程师预测年底软件工程智能体能力,谈 RL 及 DeepSeek,还提到模型自我意识、推理计算瓶颈等问题。
Meta重组AI团队后首个模型来了:不是最强、不再开源、可能够用
当地时间4月8日Meta发布Muse Spark,是重组AI团队后首个模型。它计算效率有提升,在多模态和健康任务领先,但在编程等场景落后。该模型闭源,适配Meta产品,未来优先产品再生态。
极海芯赋能光伏清洁机器人,边缘AI助力光伏行业降本增效!
全球能源转型使光伏发电装机量攀升,但面板污染物影响发电效率。传统清洁方式有弊端,光伏清洁机器人应运而生且市场增长快。极海提供‘控制+电机+驱动’芯片组合方案,赋能机器人降本增效。
比iPhone更疯狂!乔布斯去世15年后,「最像他的人」操刀首款AI硬件
2026年1月,OpenAI首款硬件“Sweetpea”路线图泄露,9月将发布。其形似“蛋石”充电盒内藏耳后设备,搭载顶级芯片,成本高。Jony Ive操刀设计,目标取代iPhone,OpenAI首年计划产销4000 - 5000万台。
老黄封神!英伟达市值首破4万亿美元,全球第一
英伟达成为全球首个市值破4万亿美元的公司,超过英、法、德等国股市总和。投资者抢购其AI芯片,股价自4月低点狂飙89%。其市值增长加速,华尔街分析师将目标指向6万亿美元。
三个月、零基础手搓一块TPU,能推理能训练,还是开源的
加拿大西安大略大学工程师暑期打造开源 ML 推理、训练芯片 TinyTPU。他们非专业出身,从基础学起。还介绍了造 TPU 原因、硬件知识、构建方法,及推理、训练的实现。
【CUDA 博客】使用PTX指令更高效地加载和存储矩阵
文章围绕使用PTX指令高效加载和存储矩阵展开,介绍`ldmatrix`和`stmatrix`指令格式、适用GPU版本、地址计算逻辑等,给出不同矩阵数量的实现代码示例,助读者理解和应用。
Meta打碎Transformer 8年铁律!改写AI最底层规则,模型首次冒出潜意识
Meta推出「自由Transformer」新模型,打破自2017年以来GPT模型核心规则,在解码器引入潜在随机变量Z,增加“潜意识”。仅增约3%计算开销,在多测试中超越大规模模型,或开启后自回归时代。
扩散语言模型九倍推理加速!上海交大:KV Cache并非自回归模型的专属技巧
上海交通大学EPIC Lab团队提出免训练推理缓存机制dLLM - Cache,复用特征降低计算量。它即插即用,通用于主流dLLM架构,在多个基准测试中实现数倍推理加速,且不降低生成质量。
将注意力旋转 90 度!今天,Kimi 的「注意力残差」火了
Kimi团队发布技术报告Attention Residuals,用依赖输入的注意力机制取代标准深度递归,解决传统残差连接的信息稀释和隐藏状态爆炸问题。实验显示其有计算优势,下游任务表现佳。