算法效率」共找到 1710 篇相关文章

算法论文8

VLM 实现 10%的精度提高,13.1倍加速!纽约大学新算法让视觉语言模型更小、更快、更准确

纽约大学研究团队用QSVD新方法让视觉语言模型(VLM)效率飞跃,在普通GPU上实现13.1倍加速。它将Q、K、V矩阵捆绑处理,设计秩分配策略,引入量化方案,经多模型评估,展现出低硬件成本、高精度优势。

AIGC开放社区
算法论文8

社交Agent: 通过RL学习自适应Thinking,根据场景在“秒回”和“深思”间灵活切换

现有聊天机器人在人情世故场景表现不佳,论文指出大模型思维‘一根筋’。研究团队设计4种思维模式,用AMPO强化学习算法动态切换。在模拟社交任务中,AMPO表现超GPT - 4,省时高效。

深度学习自然语言处理
算法论文7

谷歌TurboQuant会绕过“内存墙”?这个判断有点过了|甲子光年

谷歌发布的TurboQuant论文引发市场震动,其算法可将大语言模型推理的KV缓存大幅压缩并加速。但将其视为绕过‘内存墙’判断过度,它提升单位字节信息密度,改变边际需求曲线,代表范式转移。

甲子光年
算法论文8

情人节暴击!下跪求婚的可以是机器人了

情人节,Unitree G1 人形机器人解锁求婚技能。背后是清华叉院等联合团队的 HuMI 框架,解决人形机器人数据采集难、效率低问题,通过硬件、交互与算法协同,实现低成本、高效全身操作策略学习。

机器之心
算法论文7

苹果出手!改进GRPO,让dLLM也能高效强化学习

苹果研究团队针对扩散语言模型(dLLM)在编码任务中表现不明的问题,基于7B级代码生成MDM DiffuCoder展开研究,定制优化GRPO提出coupled - GRPO算法,填补开源dLLM训练和推理机制空白。

机器之心
开源动态8

SOP:具身智能在线进化新范式,为大规模真实世界部署而生

智元机器人具身研究中心提出SOP在线后训练系统,将VLA后训练重构为“在线、集群、并行”,可即插即用后训练算法。它有高效探索、缓解偏移等优势,实验显示能提升性能、效率,突破VLA瓶颈。

PaperAgent
新闻资讯7

ChatGPT转型计划曝光!不再只是回答问题,而是通过穿插使用工具变身行动助手

OpenAI CPO Kevin Weil在访谈中透露,ChatGPT将从回答问题转变为为用户做事,通过穿插使用工具解决复杂问题。当下模型成本已是GPT - 4的500倍,未来将不断降低API价格,还提及模型效率突破关键等内容。

量子位
算法论文8

首次结合RL与SFT各自优势,动态引导模型实现推理⾼效训练

新一代大型推理模型在复杂推理有进展,核心是ZERO - RL训练法。华为香港研究所小艺团队等合作推出GHPO算法框架,融合在线强化学习与模仿学习,解决了RLVR方法局限,提升模型训练效果,代码数据开源。

机器之心
新闻资讯8

Meta华人新秀毕树超,重磅爆料下一代LLM路线!RL+预训练直通AGI

OpenAI前研究员、Meta成员毕树超在哥大演讲指出,AGI需高质数据、好奇驱动探索与高效算法,Scaling Law有效,规模决定智能,终身学习是重点,还探讨了AGI面临的诸多问题与挑战。

新智元
算法论文8

让离线强化学习从「局部描摹」变「全局布局」丨ICLR'26

现有生成式离线强化学习方法在复杂连续任务长程规划中易陷入局部合理但全局偏航的窘境。厦门大学和香港科技大学提出MAGE算法,采用自顶向下策略,实验显示其多任务表现出色、推理效率高。

量子位