「高性能计算」共找到 3867 篇相关文章
舍弃 VAE,预训练语义编码器能让 Diffusion 走得更远吗?
纽约大学谢赛宁团队、清华&快手 Kling 团队的研究者指出 VAE 制约当前 Diffusion 范式,提出用预训练视觉模型作语义编码器改进。介绍了 VAE 不足及 RAE、SVG 工作如何解决问题,将扩散模型从‘压缩优先’转为‘语义优先’。
当 Kafka 架构显露“疲态”:共享存储领域正迎来创新变革
沃尔玛开发者 Ankur Ranjan 与 Sai Vineel Thamishetty 长期关注 Apache Kafka 与流处理系统。文章指出 Kafka 架构现局限,介绍下一代开源项目 AutoMQ 借助云原生设计,解决其成本、扩展性与运维痛点,为实时数据流架构提供新视角。
vLLM PIECEWISE CUDA Graph 技术学习笔记
文章围绕vLLM PIECEWISE CUDA Graph技术展开,介绍了vLLM Compilation架构、分片编译技术、算子融合、集合通信融合、编译缓存、装饰器系统等内容,PIECEWISE技术让vLLM在prefill阶段性能提升。
API协议全景图:从REST到MCP的选型指南
本文以开源项目 HiMarket 为背景,梳理从传统 Web 到现代 AI 场景下六种主流 API 协议,如 RESTful、GraphQL 等,介绍其核心定位、技术特点与适用场景,助开发者厘清相关概念。
开源TTS语音新标杆!Kyutai TTS:350ms延迟碾压全场,词级时间戳重构!
法国AI实验室Kyutai开源高性能TTS语音模型Kyutai TTS,基于DSM框架,支持流式输入、超低延迟与高保真语音生成,有多项亮点,还给出不同使用方式及应用场景。
华为CloudMatrix重磅论文披露AI数据中心新范式,推理效率超NV H100
华为发布60页重磅论文,提出下一代AI数据中心架构Huawei CloudMatrix及产品CloudMatrix384。它架构设计独特,性能高效准确灵活,打破算力、延迟和成本“不可能三角”,重新定义AI基础设施。
苹果AI 路线图曝光:从未打算开发聊天机器人
苹果软件工程高级副总裁Craig Federighi在WWDC 2025表明,苹果从未打算开发聊天机器人,而是要将智能深度整合到所有平台体验中,实现环境智能,此言论引发网友热议。
黄仁勋:没有AI,英伟达依然是巨无霸!盛赞中国算力与能源优势
英伟达CEO黄仁勋在播客对话中称,即便AI未出现,英伟达靠加速计算也能成巨无霸。他盛赞中国算力与能源优势,反驳中国缺AI芯片的观点,还谈及错失与OpenAI等合作的经历。
Vector数据库退位,AI记忆Memvid登场!
近期基于视频的AI记忆库Memvid大火,宣称革新AI记忆管理,能将文本片段存于MP4实现快速语义搜索。不过网友分析,它底层用FAISS,读写慢、文件大,仓库issues也显示其性能与声称相反。
《生化危机》女主演跨界AI拿SOTA了!打造免费“AI记忆系统”爆火GitHub
《生化危机》女主角Milla Jovovich与程序员老友及Claude合作,打造开源免费的AI记忆系统MemPalace。该系统在多项测试中成绩优异,采用“记忆宫殿法”,检索效率提升34%,还设计了AAAK语言,成本低且精度高。