推理范式」共找到 2838 篇相关文章

开源动态7

梳理SGLang中DP Attention及其Padding问题

作者梳理SGLang中DP Attention及其Padding问题。介绍DP Attention背景、流程,指出padding分max和sum模式,旧版sum padding浪费计算、影响cuda graph使用,v0.4.10后有优化,max padding仍待完善。

GiantPandaLLM
推荐文章8

GPT-5 = Scaling Law失效?毕树超:永远有效,因为它反应的是数据结构,客观规律

Shuchao Bi在哥大演讲阐述AI发展。回顾自监督与强化学习路径,指当前发展遇高质量数据瓶颈,认为Scaling Law不会失效。还探讨通往AGI面临的问题,畅想AI重塑世界,提出两个理解AI发展的心智模型。

AI寒武纪
产品应用8

让64张卡像一张卡!浪潮信息发布新一代AI超节点,支持四大国产开源模型同时运行

浪潮信息发布新一代AI超节点“元脑SD200”,可让64张卡像一张卡。它支持四大国产开源模型同时运行,实现算力聚合突破,通过软硬协同优化提升推理性能,采用开放架构推动“智能平权”。

量子位
推荐文章8

长上下文不再难:KV Cache 全生命周期优化实战

长上下文大语言模型发展带来计算和内存挑战,现有基准测试多忽视 KV 缓存完整生命周期。微软姜慧强在 AICon2025 分享 SCBench 工具,梳理推理优化方法,介绍 MInference 等,还提出 Tri - shape 方法等成果。

AI前线
推荐文章7

Chatbot 落幕,企业 LLM 才是 AGI 关键战场|AGIX PM Notes

文章围绕 AGI 展开深度思考,指出企业市场是 AI 革命原爆点,让企业数据适配 LLM 是前提。还提及本周市场情况,如对冲基金资金流向,以及多家公司财报超预期、微软和 Meta 加入 GSE 等动态。

海外独角兽
算法论文8

语言反思>强化学习:伯克利新架构碾压传统RL

大型语言模型下游任务优化依赖强化学习,但计算成本高。伯克利等机构论文提出GEPA新型优化器,将LLM执行轨迹转化为诊断信号,用语言反馈替代标量奖励,仅用传统方法1/35计算量,性能最高提升19%。

深度学习自然语言处理
开源动态7

突发!Qwen更新模型,全面超越kimi k2,强的离谱,主打Agent

Qwen小更新非推理模型性能强劲,各项指标超kimi k2,与Claude opus 4持平,Agent能力亮眼。Qwen团队告别混合思维模式,新模型上线,独立训练两模型,新版本多方面提升,团队称还有大招。

AI寒武纪
新闻资讯7

量旋科技完成B轮融资,资本为何重注看似遥远的量子计算?|甲子光年

近日,量旋科技完成数亿元B系列轮融资。量子计算市场前景大,虽面临挑战,但产业正从技术研发迈向产业化。量旋科技选超导与核磁共振两条技术路线,其发展分三阶段,未来或与AI结合。

甲子光年
新闻资讯8

不止AlphaFold,「药界ChatGPT」横空出世!华人女投资人深度揭秘

AI初创Chai Discovery宣布分子设计模型Chai-2重构药物设计逻辑,将抗体设计成功率从0.1%提升到16%,实现零样本设计。其联创认为这是范式革命,未来药神或成提示词工程师。

新智元
算法论文7

原来Scaling Law还能被优化?Meta这招省token又提效

2017年《Attention Is All You Need》提出的Transformer是主流语言模型基础范式。Meta新论文提出旋转不变型三线性注意力机制,证明其表现能改变Scaling Law系数,还证实2 - simplicial Transformer在有限token预算下更优。

机器之心