「多平台架构」共找到 6297 篇相关文章
CUTLASS CuTe GEMM细节分析(三)——Swizzle<B, M, S>模板参数的取值
文章以(8, 32):(32, 1)为例,探索确定Swizzle<B, M, S>中M、S和B参数的方法。指出M、S与PTX指令及共享内存多Bank结构相关,B用于指定Swizzle行数避免bank conflict,还给出不同Layout的参数取值。
最强开源Agent!Kimi K2接入Claude Code,爽翻~【喂饭级教程+实测】
上周五Kimi开源最新旗舰模型K2,它是1000B参数MoE大模型,专为Agent场景优化,API已上线且兼容多API。文章给出Kimi - K2接入Claude Code的喂饭级教程及实测,实测显示组合表现有亮点也有不足。
【博客转载】CUDA Vectorized Memory Access (文末送书)
文章展示如何用向量化内存访问提高CUDA函数有效内存带宽,实现朴素自定义设备内存拷贝函数,对比不同数据类型、大小及方法的性能,得出拷贝数据单元多、单元大及以8或16字节向量化单元拷贝可提升带宽等结论。
3D高斯泼溅,可输入视图量高达500!推理速度提升3倍,内存少80%
ZPressor能高效压缩3D高斯泼溅(3DGS)模型的多视图输入,解决其在处理密集视图时的性能瓶颈。它基于信息瓶颈原理,分三步压缩信息,降低内存占用和推理时间,提升3DGS在高视图输入下的性能。
刚刚,OpenAI正式发布o3-pro!奥特曼激动更新博客:温和的奇点
今日凌晨,OpenAI发布o3-pro,Pro订阅用户可通过ChatGPT和API使用。其在多项任务表现出色,但在ARC-AGI数据集上与o3相近且成本高。网友测试评价不一,此外OpenAI CEO奥特曼还发表博客展望AI未来。
DGM:首个可通过重写自己的代码来实现进化的AI Agent
Sakana AI发布Darwin Gödel Machine(DGM),可通过重写代码自我进化,突破了当前AI Agent智能固定的局限。它在多测试中表现出色,能力具通用性,但也有潜在风险和局限,团队已开源并提出未来研究方向。
NUS Show Lab 寿政教授:打通自回归与离散扩散,打造下一代具身大模型底座|ECCV 2026
本文整理自新加坡国立大学Show Lab负责人寿政教授在ECCV 2026的分享,团队研发融合自回归与离散扩散的Show-o/Show-2统一架构,解决多模态理解与生成融合痛点,延伸至具身智能领域,突破数据稀缺、推理延迟等核心瓶颈。
黄仁勋129亿买下AI圈GitHub!Hugging Face守了10年的独立没了
英伟达黄仁勋宣布以129.303亿美元收购Hugging Face,这是英伟达史上最大整体收购。此前Hugging Face曾拒绝英伟达5亿美元入股,如今为求发展选择被收购。英伟达借此掌控开源AI分发,承诺平台开放,但开发者利益存变数。
TRAE Work 上线 Design 模式:产品经理还需要 Figma 吗?
TRAE Work 上线 Design 模式,可将一句话描述变成可编辑设计稿,还能将设计稿转代码,在同一平台完成从需求到代码的链路。作者测试后发现其效率大幅提升,并分析了该模式与其他工具的区别及 AI 设计趋势。
1美元买10颗星?顶会曝出GitHub假星灰产,热门仓库或藏木马
ICSE顶会论文曝出GitHub上600万颗星可能是刷出来的,大量“热门项目”或为恶意软件仓库。研究团队来自多所高校和公司,公开了检测方法和源码。刷星短期有用,长期是负资产,还可能藏木马,研究团队给出治理建议。