「加速进化T1」共找到 1298 篇相关文章
[Triton编程][基础]vLLM Triton Merge Attention States Kernel详解
文章详细介绍vLLM中Triton Merge Attention States Kernel的实现,与PyTorch原生实现对比,该Triton kernel最高可实现3 - 5倍以上算子加速。内容涵盖Merge Attention States概念、PyTorch实现、Triton基础算子、分析及性能评估等。
谷歌新论文把内存股价干崩了!KV cache压缩6倍,“谷歌的DeepSeek时刻”
谷歌研究院推出TurboQuant压缩算法,可将AI推理中最吃内存的KV cache压缩至少6倍且精度零损失,还能8倍加速计算。虽引发存储芯片巨头股价下跌,但目前只是实验室成果,仅解决推理阶段内存问题。
Ilya交卷!黄仁勋砸50亿押注SSI,首个模型疑本周发布
Ilya Sutskever创立的SSI或本周发布首个重磅模型,引发圈内关注。英伟达砸50亿美元合作,提升其算力。该模型基于测试时训练架构,能边学边进化,或终结大模型“预训练时代”。
Karpathy:LLM渴望的不是生存,而是你的点赞
Andrej Karpathy指出人们对‘智能’理解肤浅,动物智能与LLM智能源于不同优化压力。动物智能源于自然选择,而LLM智能来自统计模拟、强化学习微调等,两者在多层面有差异,LLM受商业进化影响大。
突发!特朗普刚刚发布《美国AI计划》,OpenAI、微软、亚马逊成大赢家
今天凌晨,特朗普公布《美国AI行动计划》,含加速AI创新、构建基础设施、主导外交安全三大支柱及90多项行政命令,旨在让美成全球AI霸主,还将中国列为对手,多官员表态肯定该计划。
比Vibe Coding强100倍!字节 Trae 2.0 携“上下文工程”登场:一句话,从需求干到上线!
字节跳动的AI编程助手Trae发布2.0版本,新增SOLO模式,支持端到端开发流程。上下文工程热度攀升,能解决AI代码落地问题。Trae迭代快,从基础问答进化为智能体系统。
老黄喝豆汁「破防」背后,国产GPU正在填上CUDA护城河
老黄喝豆汁刷屏,但更值得关注的是国产GPU生态。摩尔线程发布会展示MUSA生态,实现全方面覆盖,从兼容到自进化,在云端、端侧应用出色,还打通全链路,且未用最强架构。
Manus走了,原生Agent登场:“AI助手”的第三次重新定义
文章回顾“AI助手”三次预期校准,指出Manus完成Agent启蒙使命,随后分析Agent发展现状,提到其将从炫技到日常,还指出Chat时代落幕,中国模型创业者正加速,探索谁能成“中国的Anthropic”。
GPT-5.2来了!首个「专家级」AI复仇成功,牛马打工人终于得救了
OpenAI发布GPT - 5.2「全家桶」,含即时、思考、专业三款模型。它全方位碾压谷歌Gemini 3 Pro,在多方面进化,虽价格涨40%,但性价比更高,还适合多种专业工作,甚至能辅助科研。
LLM的RL训练轨迹竟然是线性的?Miaow Lab|新工作:无需继续训练,直接“预测”未来模型!
文章介绍《Not All Steps are Informative: On the Linearity of LLMs' RLVR Training》,揭示RLVR训练中LLM权重和输出概率线性变化,提出“权重外推”法,可实现6.1倍训练加速,还介绍三种策略及实验结果。