「高性能计算芯片」共找到 2905 篇相关文章
Dario Amodei 达沃斯访谈全记录:AI 的力量与风险
2026 年 1 月 20 日达沃斯论坛,Anthropic CEO Dario Amodei 接受专访,谈及 AI 发展程度、公司定位、中美竞争等多话题。他认为 AI 呈指数增长,一两年内或超人类,同时警告岗位消失、财富差距等风险。
顶级视频模型半衰期只有 30 天,但生成式媒体 infra 公司的收入却在一年增长了 60 倍
文章聚焦生成式媒体 infra 公司 fal.ai,其借统一 API 和云端平台让开发者高效调用多模态模型。深入分析其成功因素,如早期押注生成式视频、优化算力和成本、构建生态等,还探讨用户使用模式与行业发展趋势。
人大高瓴赵鑫团队新作:先拆掉 RLVR,再重建推理模型训练
人大高瓴赵鑫团队围绕RLVR框架做系统实验,完成论文《A3PO: Adaptive Asymmetric Advantage Shaping for Reasoning Models》,提出A3PO方法。该方法将训练重点转向关键决策点,让推理模型学习更可控。
DeepSeek-V4蓄势待发!梁文锋署名论文或开启第二个DeepSeek时刻
据报道,DeepSeek将于2月发布新一代旗舰模型DeepSeek V4,其编程能力或超Claude和GPT系列。最新论文提出Engram条件记忆机制,分离死记硬背与逻辑推理,揭示新稀疏性分配定律。
《生成式AI卓越架构设计指导原则》:从"能用AI"到"用好AI"
在2025云栖大会上,阿里云发布《生成式AI卓越架构设计指导原则》,以云原生“卓越架构五大支柱”为基础,针对大模型内容合规与安全治理等领域提建议,助力企业从‘能用AI’走向‘用好AI’。
多模态推理新范式:上海AI Lab新作证明“画”出答案比“说”出答案更靠谱
上海人工智能实验室等联合提出DiffThinker模型,利用扩散模型构建全新视觉推理范式。它在视觉中心任务上表现优异,准确率碾压GPT - 5等模型,还能与MLLM协同推理实现1 + 1 > 2的效果。
下载量超 1300 万,昇思 MindSpore:AI 框架迈入“超节点时代”
开源五周年,昇思 MindSpore 成绩亮眼,下载量超 1300 万。它完善大模型、部署、科学计算等核心能力,还提出 HyperParallel 架构应对新挑战,正式版及套件明年上半年发布,未来社区将多方向推进。
港大联合字节跳动提出JoVA: 一种基于联合自注意力的视频-音频联合生成模型
香港大学联合字节跳动提出视频 - 音频联合生成框架 JoVA,支持音视频 Token 跨模态交互,引入嘴部区域特定损失解决口型同步问题。实验显示,它用约 190 万条数据就达先进水平。
即将开源 | 阿里云Tair KVCache Manager:企业级全局 KVCache 管理服务的架构设计与实现
阿里云Tair KVCache团队联合多团队将开源Tair KVCache Manager,介绍其架构设计与实现。该服务应对Agentic AI下KVCache存储挑战,解决传统模式难题,具备企业级管理能力,后续还会完善多方面功能。
4000 Star,Vibe Coding终级指南:胶水编程
Vibe Coding由karpathy提出,本文分享其终极指南。介绍了胶水编程、方法论精要、工具资源、编码模型性能分级参考等内容,还给出架构与工作流程,建议选第一梯队模型处理复杂任务。