推理芯片」共找到 2584 篇相关文章

算法论文8

西湖大学提出RDPO强化学习框架,实现扩散模型并行推理加速

扩散模型“顺序去噪”特性成速度提升瓶颈。西湖大学AGI Lab提出RDPO框架,不必改动模型本身,优化其“采样导航系统”,在多基准测试中取得领先图像生成效果,解决加速问题并提供RLHF对齐新范式。

量子位
算法论文8

AAAI 2026 Oral|LENS:基于统一强化推理的分割大模型

文本提示图像分割技术有战略意义,但基于监督式微调的方法有泛化能力瓶颈。为此引入LENS框架,采用强化学习机制,还介绍其架构、奖励机制,该框架在测试中表现优异,代码已开源。

机器之心
新闻资讯7

苏姿丰出手!Oracle下单5万颗AMD芯片,英伟达王座撼动

Oracle宣布2026年第三季度起在云基础设施部署5万颗AMD Instinct™ MI450系列GPU构建AI超级集群并持续扩容。AMD Instinct MI450系列GPU亮点多,此次合作是其与Oracle合作的深化,也被视为AMD挑战英伟达的关键突破。

新智元
开源动态8

模仿人类推理修正过程,阶跃星辰提出形式化证明新范式 | 开源

阶跃星辰发布并开源形式化定理证明大模型 StepFun-Prover-Preview-7B 和 32B。采用两阶段监督微调、工具集成强化学习及 RL 与 SFT 迭代循环优化等策略,在基准测试集表现佳,还展示多个证明案例。

量子位
新闻资讯7

Claude两个新模型实测流出!空间推理封神,算力直接榨干了

Claude两款新模型“棉花糖”和“甜瓜”实测流出,在3D强化学习和建筑空间布局上性能强大,还能直接理解并生成复杂3D坐标和空间关系。它们对算力吞噬疯狂,引发对其身份的猜测。

新智元
算法论文8

强化学习没作用?人大DelTA精准识别关键token,推理正确率大幅上升

人大高瓴研究团队提出DelTA算法,不依赖经验为强化学习目标中每个token算最优权重。实验显示它适配主流强化框架,在多任务上提升base模型效果,还能让训练更稳定。

量子位
产品应用8

将DSA注意力引入多模态,快手Keye2.0开启强化推理新范式

快手发布新版多模态大模型Keye-VL-2.0-30B-A3B,率先将DSA机制引入多模态理解场景,解锁256K超长上下文深度感知,还首次解锁Agent协作机制。该模型在多方面表现出色,且将融入业务带来收益。

量子位
新闻资讯8

老黄秘密武器曝光:AI一夜设计芯片,顶人类顶级工程师10个月!

英伟达在GTC大会揭露用AI设计GPU,原本8名工程师10个月的任务,AI一夜完成。其开发NB - Cell、Prefix RL等工具,还推出内部大模型Chip Nemo和Bug Nemo,不过完全端到端自动化设计仍有距离。

新智元
开源动态7

OpenClaw引爆的AI Agent浪潮中,终于有芯片给端侧“解渴”了

OpenClaw让AI Agent成产业竞赛焦点,但云端方案算力、成本和安全问题凸显。瑞芯微推出端云协同方案ClawChips,采用算力解耦架构,在成本与场景适配间找平衡,还开源并提供开发套件借用权益。

芯师爷
新闻资讯8

黄仁勋:芯片公司的时代已经结束了,现在是 AI 工厂的时代

Lex Fridman 采访黄仁勋,黄仁勋谈对 AI 行业理解,认为 AI 是工业产品,NVIDIA 像建 AI 工厂。还提及算力是智能扩展关键,计算从检索转向生成,Token 细分市场,以及公司组织、架构、开源等多方面观点。

Founder Park