「内存密集型内核」共找到 304 篇相关文章
苹果M5「夜袭」高通英特尔!AI算力狂飙400%,Pro三剑客火速上新
苹果悄无声息更新官网,三款核心产品14寸MacBook Pro、iPad Pro以及Vision Pro换上全新M5芯片。M5芯片性能提升显著,AI能力连翻数倍,加量不加价,在AI、图形处理等多方面有重大升级。
日志采集效能跃迁:iLogtail 到 LoongCollector 的全面升级
2025年,iLogtail正式升级为LoongCollector,实现日志采集和处理领域的新跨越。它架构升级,有多样Pipeline形态,性能提升,稳定性和隔离性增强,还具备网络探测、无缝迁移等优势,将带来可观测数据全栈采集新体验。
英伟达和AMD,开始争夺AI制药的计算入口
每年的 Advancing AI 大会,AMD 都要回答 Instinct GPU 除训练大模型外的应用问题。今年大会上,AMD 把一个位置留给 AI 制药公司 MindWalk。而其对手英伟达已在生命科学领域布局多年,生命科学成两家竞争新战场。
跨层压缩隐藏状态同时加速TTFT和压缩KV cache!
论文 UNCOMP 被 EMNLP 2025 主会接收,提出高效推理框架,用截断矩阵熵解释 LLM 稀疏化,据此设计 UNCOMP 框架,通过压缩隐藏状态优化 KV Cache,实现计算与内存联合优化,实验效果显著。
FlashAttention-4震撼来袭,原生支持Blackwell GPU,英伟达的护城河更深了?
在 Hot Chips 2025 上,TogetherAI 首席科学家 Tri Dao 公布 FlashAttention-4,其在 Backwell 上比英伟达 cuDNN 库中的注意力核实现快 22%,还实现两项算法改进。该技术一直迭代升级,提升了注意力计算效率。
告别单Agent,AI Agent进入团战时代!
上周CAMEL - AI开源Eigent,号称“全球首个桌面端多智能体生产力团队”,后脚Manus上线功能相似的“Wide Research”。本文分享Eigent内核,介绍其特色、与Manus对比,还深挖技术架构、MCP及容错机制。
大规模替换数据库序列,保障百余个服务平稳运行
Coupang从关系型数据库迁移到NoSQL时,为解决序列替换问题,自研了专用解决方案。该方案采用双层缓存与滑动窗口预填充机制,以DynamoDB为数据源,让百余个服务无需重写代码完成迁移,性能和成本表现佳。
微软介绍了 TypeScript 7 的更新
微软分享 TypeScript 7 最新进展,披露用 Go 重写编译器计划,构建速度最高提 10 倍,降低内存占用。默认启用严格模式,是不兼容变更。开发者看法不一,有人赞性能提升,有人忧工具迁移。
不上云、不租卡,如何优雅地在本地微调Qwen-VL-30B?
文章指出企业训练多模态助手,30B 参数的开源多模态模型如 Qwen-VL-30B 是不错选择,但多模态场景下显存需求大。联想 ThinkStation PGX 解决了显存难题,还介绍其性能、优势、适用场景及服务等。
存储芯片“局中局”
2025年10月,OpenAI与三星、SK海力士签协议锁定大量DRAM晶圆供应,致合约与零售市场价格跳涨。需求激增、生产结构转向使内存暴涨无解。科技巨头应对不同,制造商因曾产能过剩不敢增产。