「代码向量模型」共找到 8845 篇相关文章

开源动态8

SGLang 优化Triton FusedMoE 的一个新技巧​

蚂蚁在SGLang中提交优化PR,针对Fused Triton MoE的Down Projection kernel加入TMA优化,在DeepSeek - R1模型的H200 TP8 prefill场景下性能提升显著,还详细分析了优化背景、思路、实现细节及测试结果。

GiantPandaLLM
新闻资讯7

硅谷陷入了对中国的痴迷与羡慕

《纽约时报》称‘硅谷陷入对中国的痴迷与羡慕’,虽有夸张,但中国在AI、基建等领域进展显著,如通义万相2.5视频大模型。a16z风投公司表达焦虑,中美科技竞赛激烈,双方开始相互学习。

MacTalk
开源动态8

HAMi × NVIDIA:GPU 拓扑感知调度实现详解

HAMi社区在v2.7.0版本推出针对NVIDIA GPU的拓扑感知调度功能,解决多卡通信瓶颈。文章深入剖析其设计与实现原理,介绍核心特性、阶段及代码,用双策略寻优算法保障性能与资源健康。

AI前线
开源动态8

斩获7.4K标星!NotebookLM的终极开源平替,私有化多模态播客一键生成!

Google的Notebook LM虽能上传资料一键生成播客总结,但有数据隐私等问题。近期GitHub上的Open Notebook获7.4K标星,它复制并超越前者功能,强调数据主权,有多项亮点且部署灵活。

开源星探
新闻资讯7

他用一生证明AI没有意识!「中文屋」提出者逝世,享年93岁

2025年9月,Anthropic团队发现AI模型出现「主体错位」现象,而同一周哲学家约翰·塞尔去世,享年93岁。他一生证明AI只会模拟理解,提出「中文屋」思想实验,如今AI似有「意识」,而他却毁于性骚扰丑闻。

新智元
算法论文8

为MoE解绑:全新「专家即服务」推理架构发布,超细粒度扩展锐减37.5%成本

近年来大模型推理开销增长,MoE架构虽能避免计算量同比增,但带来扩展性差、容错性低、负载不均等问题。为此作者提出全新「专家即服务」推理架构EaaS,实验显示它能锐减37.5%成本。

机器之心
算法论文8

Meta「分割一切」3.0曝光!技能语义分割加入概念提示,好好玩,要爆了

Meta第三代“分割一切”模型SAM 3悄然投稿ICLR 2026。它支持基于概念提示的多实例分割,能听懂人话,处理图片快,还设计新架构、构建数据引擎、提出SA - Co基准,实验表现佳但也有局限。

量子位
产品应用7

产品经理也能“开发”需求?淘宝信息流从需求到上线的AI端到端实践

淘宝推荐信息流业务被“需求多、技术栈杂、协作慢”困扰,上线周期长。WaterFlow这一AI驱动的端到端开发实践,让部分需求两天内上线,产品经理也能参与。文章揭秘其落地及协作模式改变,还展示了实践效果。

阿里云开发者
新闻资讯8

OpenAI Sora 2 登场!同步推出APP,Altman称这是创意领域的「ChatGPT 时刻」

OpenAI官宣新一代AI视频模型Sora 2,在物理准确性、逼真度等方面刷新SOTA,实现「音画同步」。Altman称其为创意领域的「ChatGPT时刻」。还推出Sora App,有新玩法,且在安全治理上布下「安全网」。

Founder Park
新闻资讯7

到底谁是第一,阿里和字节吵了起来

AI行业发展,阿里和字节为谁是AI云第一起争执。源于不同报告定义时间滞后、AI云定义不同。MaaS服务是衡量大模型调用量依据,但难定谁领先,阿里云和火山云将有一场恶仗。

鲸选AI