共享内存」共找到 345 篇相关文章

新闻资讯7

每周产业洞察 | AI视听重构产业逻辑:硅谷“算账”之时,好莱坞“造梦”法则失效

北京AIGC视听产业创新中心位于朝阳区东坝乡,由多方参与,采取“共创、共建、共享”模式。由首创郎园负责运营,提供六大服务平台,推动视听产业集群化发展,截至2025年8月已汇聚近百家合作伙伴。

郎园Station
产品应用8

阿里在海外上了个“企业级龙虾”,我用它30分钟手搓了一家网店

阿里在海外上线企业级Agent Accio Work,用户30分钟就能用它开网店。它无需部署,内置生意Skill,7x24小时帮忙选品、采购、运营等,还解决了全球电商信息壁垒、流程复杂、成本高昂等问题。

量子位
新闻资讯7

每周产业洞察 | 中制协“开年第一会”的三个信号

北京AIGC视听产业创新中心位于朝阳区,是朝阳区推动影视制作基地建设的重要举措。由多方参与,采取‘共创、共建、共享’模式,提供六大服务平台,已汇聚近百家生态合作伙伴,由首创郎园负责运营。

郎园Station
开源动态8

全球开源 AI 生态的未来:从 DeepSeek 到 AI+

这是关于中国开源社区自2025年1月‘DeepSeek时刻’以来进展的系列博客最后一篇,介绍中国AI企业和机构发展路径,展望开源未来方向,指出全方位开放共享成关键路径,‘有机生态’正成型。

Hugging Face
算法论文8

跨层压缩隐藏状态同时加速TTFT和压缩KV cache!

论文 UNCOMP 被 EMNLP 2025 主会接收,提出高效推理框架,用截断矩阵熵解释 LLM 稀疏化,据此设计 UNCOMP 框架,通过压缩隐藏状态优化 KV Cache,实现计算与内存联合优化,实验效果显著。

机器之心
新闻资讯7

FlashAttention-4震撼来袭,原生支持Blackwell GPU,英伟达的护城河更深了?

在 Hot Chips 2025 上,TogetherAI 首席科学家 Tri Dao 公布 FlashAttention-4,其在 Backwell 上比英伟达 cuDNN 库中的注意力核实现快 22%,还实现两项算法改进。该技术一直迭代升级,提升了注意力计算效率。

机器之心
开源动态8

SGLang 2025-8月性能优化技巧记录

本笔记记录2025年8月SGLang框架性能优化实践,涉及GPT - OSS、DeepSeek - V3等模型,采用allreduce_add_rmsnorm、量化、通信、内核融合等优化技术,在性能提升、减少延迟等方面效果显著。

GiantPandaLLM
新闻资讯8

AI教父辛顿上海WAIC主题演讲:LLM真的理解语言,数字智能极其危险,可以无限复制

AI教父杰弗里·辛顿在WAIC开幕式演讲,对AI发展警惕且悲观。他认为LLM真理解语言,数字智能与生物智能差异大,AI进化快很危险,人类应全球合作研究让AI向善。

AI寒武纪
开源动态8

本周推荐的5个超级6的Github开源项目!

文章推荐5个Github开源项目。有基于Firefox内核的浏览器Zen Browser;跨平台划词翻译工具Pot;异步终端文件管理器yazi;局域网文件传输工具Snapdrop;网页管理服务器文件工具FileBrowser Quantum,各有亮点。

开源先锋
开源动态8

终于开源升级OmniGen2,统一多模态图像生成模型,真的惊艳。

OmniGen2是强大的开源统一多模态图像生成模型,针对文本和图像模态构建独立解码路径,运用未共享参数。新架构提升处理效率和质量,在图像编辑等任务表现出色,还有多技术特点。

开源AI项目落地