前缀和计算」共找到 7280 篇相关文章

开源动态8

蚂蚁开源 x SGLang Meetup技术回放解读之基于CUTE DSL的通信计算重叠算子实践

文章是对蚂蚁开源x SGLang Meetup分享的回放解读,聚焦基于CuTe DSL的通信 - 计算重叠内核实践。探讨不同通信计算重叠方案,分析在Blackwell上做GEMM + AllReduce融合算子的优势,介绍multimem指令等,还提及接入模型执行路径性能结果。

GiantPandaLLM
新闻资讯7

Grok 4基准测试被爆极其优异,人类终极考试成绩飙升到45%,碾压o3 Gemini的20%

API开发者曝光Grok - 4Grok - 4 Code测试成绩,HLE达35%,推理后飙升到45%,远超o3Gemini的20%。其他测试也表现优异,但成绩引发争议,有人质疑数据污染,也有人支持,目前数据未官方证实。

AGI Hunt
开源动态8

Suno最强开源对手来了!ACE Studio阶跃星辰联合开源了一款音乐模型,20秒即可生成4分钟神曲!

ACE Studio阶跃星辰联合开源音乐模型ACE - Step,参数量3.5B,结合多种技术,支持多语言多风格音乐生成。20秒可生成4分钟歌曲,比传统模型快15倍,有多种功能亮点,还介绍了上手步骤应用场景。

开源星探
产品应用8

非Transformer架构落地之王,带着离线智能原生记忆能力在上海WAIC浮出水面

在上海WAIC现场,RockAI展台的机器狗灵巧手在离线状态表现出色,背后是其非Transformer架构的大模型Yan 2.0 Preview,有原生记忆离线智能能力。该公司成立两年,押注此架构,产品已商业落地,还构想群体智能未来。

量子位
推荐文章7

如何让Agent更符合预期?基于上下文工程多智能体构建云小二Aivis的十大实战经验

文章围绕云小二Aivis项目,分析Agent不按预期输出的原因,从预期技术层面展开。还总结十大优化经验,如清晰预期、精准投喂上下文等,为构建调优Agent提供参考。

阿里云开发者
算法论文8

ICML26 | 浙江理工大学马啸讲师南京大学李武军教授课题组联合提出EMCES:为强化学习合成更有价值的样本

强化学习获取高质量样本成本高、风险大,现有基于扩散模型的样本增强方法有局限。浙江理工大学马啸讲师南京大学李武军教授课题组提出 EMCES,将情景记忆机制引入可控扩散模型,提升下游强化学习算法表现,论文已被 ICML2026 录用。

机器之心
算法论文8

超越RAGDAPT!华人团队新研究引热议:即插即用、无需改变原参即可让模型化身领域专家

华人团队提出比DAPTRAG更方便、成本更低的方法,即“Memory Decoder”预训练记忆模块。它像“领域知识插件”,即插即用、不改原参,能让Qwen、Llama等模型成领域专家,还降低困惑度。

量子位
推荐文章8

模型压缩与量化:让大模型走向轻量化落地

文章介绍模型压缩与量化技术,其能在保持性能时降低大模型计算存储需求,实现边缘设备高效部署。还阐述基础知识、关键技术路径、应用场景,并探讨未来发展方向。

机器学习AI算法工程
算法论文7

《TAML》好文推荐 | 来自中国科学院力学研究所张磊博士 评估大语言模型在计算流体力学领域的知识利用、学习与创造

研究聚焦评估推理型(DeepSeek R1OpenAI o3 - mini - high)与非推理型(DeepSeek V3ChatGPT 4o)大语言模型在计算流体力学领域知识利用、学习与创造能力。通过三类基准问题评估,结果有差异。

力学与人工智能
新闻资讯7

国内AI应用半年报告:AppWeb应用月活都在跌,AI搜索需求被验证,百度是DeepSeek流失用户最大接盘手

QuestMobile发布2025年国内AI应用上半年报告,指出国内与海外市场情况不同,国内移动端PC端AI产品月活下滑,AI搜索需求被验证,百度成DeepSeek流失用户最大接盘手,还分析了各类型AI应用发展态势。

Founder Park