「内存优势」共找到 1287 篇相关文章
【博客转载】CUDA Constant Memory
文章介绍 CUDA 常量内存,它是设备上 64KB 被缓存的只读特殊内存空间。通过示例比较不同访问模式下常量内存和全局内存性能,指出块或 warp 一次访问时,常量内存快 10%;线程一次或伪随机访问时,慢很多。
【博客转载】CUDA Vectorized Memory Access (文末送书)
文章展示如何用向量化内存访问提高CUDA函数有效内存带宽,实现朴素自定义设备内存拷贝函数,对比不同数据类型、大小及方法的性能,得出拷贝数据单元多、单元大及以8或16字节向量化单元拷贝可提升带宽等结论。
揭秘!RLVR/GRPO中那些长期被忽略的关键缺陷
近年来大模型任务突破离不开RLVR关键技术,许多RLVR方法会进行组内优势估计,北航等最新工作揭示其存在系统性偏差,困难题优势被低估,简单题被高估。这会影响训练,论文提出校正算法。
Kotlin Multiplatform 评估:跨平台开发中的优势与权衡
文章评估了 Kotlin Multiplatform(KMP)在跨平台开发中的优劣势。KMP 可共享代码,编译成原生代码获出色性能,保留原生 UI 选项。虽生态小、有学习曲线等问题,但 Netflix 等大公司已用,未来潜力大。
AI产品先发优势在于用户迁移成本高,持续为用户提供价值是保持竞争优势的关键 | 对话AI智能电子衣橱工具搭搭
文章围绕AI智能电子衣橱工具搭搭展开,介绍其功能、开发逻辑与发展规划。搭搭通过AI算法筛选美图定义美,提供穿搭灵感,注重用户需求。团队投入研发,获客成本低,未来聚焦工具,解决穿搭问题,与用户共建产品。
Transformer危!谷歌MoR架构发布:内存减半推理速度还翻倍
谷歌推出全新底层架构Mixture-of-Recursions(MoR),推理速度提高2倍、KV内存减半,首次在单一框架实现多任务处理与动态分配计算资源,研究人员通过实验验证其性能超Transformer。
黄仁勋:没有AI,英伟达依然是巨无霸!盛赞中国算力与能源优势
英伟达CEO黄仁勋在播客对话中称,即便AI未出现,英伟达靠加速计算也能成巨无霸。他盛赞中国算力与能源优势,反驳中国缺AI芯片的观点,还谈及错失与OpenAI等合作的经历。
内存四年涨700%,长鑫LPDDR6送样能把价格打下来吗
近期“长鑫DDR6送审”刷屏,实则涉及技术进度、资本事件、供应链前置动作。文章分析长鑫进展含金量,认为国产DRAM首次和国际标准处同一窗口。此轮存储涨价因HBM抽走通用产能,长鑫或补通用市场空缺。
英伟达都摁不住了!内存疯涨,AI服务器被曝涨价超15%
搭载英伟达AI芯片的服务器将在2027年初涨价超15%,但这次并非英伟达主导,而是代工厂。真正原因是内存价格疯涨,三星、SK海力士和美光掌控近九成市场,有定价权。
SpaceX:天基基础设施垄断者
传言SpaceX明年将IPO,作者认为其正把‘先发优势’转为‘物理垄断’,将成‘人类未来天基基础设施的唯一垄断者’。它有极强运力成本优势,能抢占轨道和频谱资源,变现方式或为把GPU发上天。