「计算效率」共找到 1778 篇相关文章
VLM 实现 10%的精度提高,13.1倍加速!纽约大学新算法让视觉语言模型更小、更快、更准确
纽约大学研究团队用QSVD新方法让视觉语言模型(VLM)效率飞跃,在普通GPU上实现13.1倍加速。它将Q、K、V矩阵捆绑处理,设计秩分配策略,引入量化方案,经多模型评估,展现出低硬件成本、高精度优势。
杨植麟回复:Kimi K2训练用的H800!但“只花了460万美元”嘛…
月之暗面团队回应Kimi K2 Thinking训练成本,透露用英伟达H800,GPU少但利用充分。该模型凭实力与低成本引迁移潮,还引发对闭源巨头估值反思。技术上有优化创新,团队还公开答疑。
3D重建的惊人进展:多所世界名校联合发布论文,告诉你AI在3D世界的研究现状
多所世界名校联合发布调查研究论文,回顾用于3D重建和视图合成的前馈技术并分类,研究关键任务及应用。前馈模型打破每场景优化魔咒,带来速度和泛化能力的提升,解锁新应用,但也面临挑战。
曾经年薪百万的架构师,如今是否要靠AI保饭碗?对话5位顶尖架构师:未来的架构师,不写代码也得懂AI
文章围绕AI时代架构师角色转型展开,多位专家认为AI引发架构师角色定位转变,新职业形态涌现。AI工具提升开发效率,架构师需转向战略层面,还探讨了AI对架构设计流程、团队协作的影响及应对建议。
【DeepSeek-OCR系列第一篇】Language Modelling with Pixels【ICLR23】
当前主流语言模型依赖固定词表,扩展到多语言、多脚本时面临覆盖受限、计算昂贵、鲁棒性差等问题。ICLR 2023论文提出不依赖词表的PIXEL模型,通过将文本变成图像用视觉Transformer理解,实验验证其有跨语言、抗噪声等优势。
中科大校友,谷歌量子处理器总监 Yu Chen 揭秘Willow量子芯片背后的“秘诀”
谷歌量子AI团队宣布“Willow”量子芯片运行“量子回声”算法,实现可验证量子优势。中科大校友、谷歌量子处理器总监Yu Chen揭秘其“秘诀”,芯片关键性能指标高,让算法运行速度提升13000倍,谷歌正迈向量子计算路线图“里程碑3”。
AI原生产品不等于全部功能AI化,保留传统功能让用户体验更完整 | 对话小卡健康
AI健康管理赛道竞争激烈,产品各有差异。量子位智库访谈小卡健康产品负责人李雅,探讨AI如何赋能、产品功能拓展、数据指标关注、智能设备联动、开发问题及运营推广等,展示其差异化策略和发展思考。
腾讯混元A13B用130亿参数达到千亿级效果,Flash Attention作者点赞
腾讯混元A13B模型仅130亿激活参数,却能和千亿级大模型竞争,获Flash Attention作者赞叹。它精准卡位性能与效率‘甜蜜点’,依托高质量预训练和结构化后训练,多方面表现突出且已全面开源。
LightLLM中DeepSeek V3/R1 Two MicroBatch Overlap 实现解析
文章围绕LightLLM中DeepSeek V3/R1的Two MicroBatch Overlap实现展开。介绍了该技术原理,通过拆分推理过程、精心设计执行顺序实现计算与通信重叠。还阐述了数据结构设计、预处理、核心执行流程,以及优化策略和配置启用方式。
微软最新财报:总营收701亿美元,云与AI业务增长强劲
微软发布2025财年第三季度财报,营收701亿美元,同比增13%。生产力与业务流程、智能云、个人计算等业务均有增长,云业务营收424亿美元,同比增20%。董事长称云与AI是关键,CFO表示业绩强劲。