双模式推理」共找到 2625 篇相关文章

产品应用8

还得是华为!Pangu Ultra MoE架构:不用GPU,你也可以这样训练准万亿MoE大模型

华为盘古团队发布Pangu Ultra MoE模型架构与训练方法的中文技术报告。该模型全流程在昇腾NPU上训练,团队在架构和训练方法创新,实现准万亿MoE模型训练,还在多方面优化提升性能。

机器之心
算法论文8

以星为舵:LLM的Post-Train与Rest-Time奖励学习综述

这篇论文提出奖励信号像AI的“导航星”,引导模型优化行为。介绍奖励学习概念、来源、形和策略,阐述其贯穿LLM生命周期的三个阶段,探讨奖励模型设计选择,还提及实际应用、挑战与未来方向。

深度学习自然语言处理
开源动态8

超越DeepSeek-R1,英伟达开源新王登顶!14万H100小时训练细节全曝光

英伟达Llama - Nemotron系列模型超越DeepSeek - R1且全部开源。论文揭秘其训练关键,如用合成数据监督微调与强化学习等。还介绍构建阶段、架构设计等,评估显示该系列模型在多任务表现出色。

新智元
算法论文8

VEGA-3D:释放视频生成模型中的隐3D知识,重塑3D场景理解与具身交互

华中科技大学与百度联合提出VEGA - 3D,释放视频生成模型隐3D知识。它将视频生成模型作‘潜在世界模拟器’,用自适应门控融合机制,提升场景理解等任务表现,无需额外3D标注数据。

机器之心
算法论文8

腾讯发布大模型思考早停算法SpecExit,效果无损,端到端加速2.5倍!

腾讯为破解大模型长思维链效率难题,提出思考早停算法SpecExit,将思考早停与投机采样融合,在不影响准确性前提下,在vLLM上实现端到端加速2.5倍,还能缩短思维链长度。

腾讯技术工程
算法论文8

MetaAI解锁Transformer潜意识,仅额外3%计算开销,性能提升最高55%

Meta FAIR研究员François Fleuret提出《The Free Transformer》,对解码器Transformer扩展。它通过引入随机变量,让模型先计划后执行,用约3%计算开销,在编程等任务上性能提升最高达55%。

AIGC开放社区
算法论文8

模型是谁的?LLM版权保护首个技术综述论文发布

浙江大学和君同未来团队发布《Copyright Protection for Large Language Models: A Survey of Methods, Challenges, and Trends》。论文以“模型指纹”为核心理念,打通三个技术流派,指出文本水印难护模型版权,还分析各类指纹技术优劣势并给出未来方向。

深度学习自然语言处理
产品应用7

对话NOOK创始人许清岚:AI 从「做事」走向「规划人生」

NOOK创始人许清岚将其产品定位为“人生外挂”,想让AI从效率工具进化到人生操作系统。它引入玄学数值体系,为用户提供人生规划。虽面临资金、日活等挑战,但早期数据不错,也有顶尖团队助力。

AI科技评论
产品应用7

真正的Jarvis要来了?涂鸦智能押注Physical AI

智能家居爆发期,诸多硬件品牌借涂鸦能力发展。如今涂鸦发布AI生活助手“Hey Tuya”,它依托自研架构补齐Agent进入物理世界的关键能力,让涂鸦从幕后走向台前,有望构建家庭生活新基础。

AI前线
算法论文8

AI终于学会「读懂人心」,带飞DeepSeek R1,OpenAI o3等模型

威斯康星大学麦迪逊分校联合清华的研究《MetaMind: Modeling Human Social Thoughts with Metacognitive Multi-Agent Systems》,将元认知理论融入LLM架构,使模型在心智理论测试达人类平均水平,揭示构建社交智能AI方法论。

AINLPer