自回归顺序」共找到 1246 篇相关文章

推荐文章8

AI Infra进阶:如何让大模型输出确定的结果

文章探讨大模型输出确定性结果的问题。指推理引擎底层动态组批与算子调度策略,因浮点加法顺序变化使结果波动。还分析GEMM、RMSNorm等算子影响,给出vLLM实现Batch Invariance的方法。

腾讯技术工程
算法论文8

ICML 2026获奖论文揭晓:黄高团队获杰出论文,A3C算法获时间检验奖

ICML 2026公布最佳论文奖项,共10篇获奖,涵盖杰出论文奖、杰出立场论文奖等。此次评选严格,经多轮筛选。获奖论文涉及扩散式大语言模型、扩散模型采样算法等多个领域。

机器之心
推荐文章8

从 AI 取数到智能分析:企业级数据 Agent 的多阶段演进与工程化落地

文章整理 Shopee 技术专家王新波在 QCon 全球软件开发大会 2026 北京站的分享。复盘团队打造企业级 Data Agent 实践,揭示技术演进路径,分享将取数工具雕琢为智能分析工具的方法。

InfoQ
推荐文章8

AI时代的人才,我觉得最重要的是这6点特质。

作者结合招聘与创业经历,分享AI时代人才应具备的6点特质:好奇心、靠谱、有事实洁癖、多元化思维、能忍受不确定性、低ego高驱。强调特质比技能更重要,与学历无关。

数字生命卡兹克
产品应用7

Claude Code 新功能 Agent Teams:4 类活效率翻倍,4 类活纯烧 token

Claude Code v2.1.32 后新增实验性功能 Agent Teams,可将其从单个 AI 助手升级为 AI 团队,但会使 token 用量线性放大。文章总结了适合和不适合用此功能的任务类型,还给出决策清单、实战避坑建议。

AI Reading Hub
算法论文8

Agent学会己「长」Skill了!从失败里长出经验,比人类写的更好用|ICML 2026

ICML 2026接收论文提出EvolveR,让Agent从身成败轨迹动蒸馏“经验”,经闭环生命周期形成“认知Skill”,维护经验库,用强化学习让其学会“使用经验”,在多跳问答表现优。

量子位
开源动态8

蚂蚁开源 x SGLang Meetup技术回放解读之基于CUTE DSL的通信计算重叠算子实践

文章是对蚂蚁开源x SGLang Meetup分享的回放解读,聚焦基于CuTe DSL的通信 - 计算重叠内核实践。探讨不同通信计算重叠方案,分析在Blackwell上做GEMM + AllReduce融合算子的优势,介绍multimem指令等,还提及接入模型执行路径和性能结果。

GiantPandaLLM
新闻资讯7

哈萨比斯出的难题,GPT之父接上了:用一个知识停在1930年的模型

GPT之父Alec Radford等用1931年前数据训练13B模型Talkie,切断现代知识污染。研究者测试其能力,探讨它对未来的“预感”、规避污染问题及数据多样性等,同时训练中也面临时间泄漏、数据质量等难题。

机器之心
推荐文章8

打字太慢?2026年开发者语音输入终极指南:12款工具横评,找到最适合你的那一个

文章是 2026 年开发者语音输入工具横评。指出 AI 编程时代语音输入成刚需,介绍 12 款工具优缺点、适用场景和价格,还给出使用技巧,作者分享己的选择组合。

AI Reading Hub
产品应用7

黄仁勋刚讲完AI「五层蛋糕」,他们就跑通了!算力、模型、Agent一次打穿

英伟达CEO黄仁勋提出「AI的五层蛋糕」架构,易鑫结合汽车金融场景构建全栈式AI体系,从基础设施到业务应用层层推进,解决行业痛点,还开源模型推动共赢。

新智元