部署时学习」共找到 2573 篇相关文章

开源动态8

开启RL Scaling新纪元,siiRL开源:完全分布式强化学习框架,支持超千卡规模高效训练

传统强化学习框架在模型和集群规模达上千块GPU,存在扩展性瓶颈和效率低下问题。上海创智学院团队推出siiRL,采用全分布式架构和多控制器范式,解决传统框架痛点,在多方面验证了其高性能。

机器之心
算法论文8

4B模型幻觉抑制能力超越GPT-5,CMU等提出行为校准强化学习新方法

大语言模型幻觉问题是部署难题,CMU等研究人员提出行为校准强化学习新方法,重新设计奖励函数。经训练,40亿参数模型幻觉抑制力超GPT - 5,实验证明该方法效果显著,还带来理论洞察。

机器之心
开源动态8

社区供稿 | 开源多模态大模型新突破,书生·万象3.5发布,通用能力、推理能力与部署效率全面升级

2025年8月26日上海AI实验室开源发布书生·万象InternVL3.5,通过创新技术实现推理、部署和通用能力全面升级。它有多种尺寸模型,多项性能领先,还加强了智能体核心能力,应用场景广泛。

Hugging Face
算法论文8

打破具身世界模型可执行性鸿沟 !港中深-跨维智能团队提出EVA框架,用强化学习让视频世界模型真正“动”起来

近期,利用视频生成模型为机器人构建“世界模型”成热门路线,但存在“可执行性鸿沟”。港中深 - 跨维智能团队提出 EVA 框架,用强化学习优化视频生成,实验显示其能提升视觉规划、仿真任务成功率及真实部署稳定性,还有数据合成潜力。

机器之心
算法论文8

经典之作!Agent无需奖励也能学习:通过“早期经验”的Agent Learning

该论文提出‘早期经验’范式,让智能体通过执行动作、观察结果状态学习,无需外部奖励。它能降低数据依赖,提升泛化与鲁棒性。实验显示,其在多样环境中效果出色,为智能体训练提供新思路。

深度学习自然语言处理
新闻资讯7

全国首部AI大模型私有化部署标准,公开征集起草单位和个人!

大模型浪潮下,企业对AI投入加大,私有化部署需求凸显,但缺乏成熟实施框架。全国首部AI大模型私有化部署标准《人工智能大模型私有化部署技术实施与评价指南》应运而生,已聚集30余家单位参编。

AI工程化
新闻资讯7

全国首部AI大模型私有化部署标准,公开征集起草单位和个人!

近期AI领域政策频出,企业对AI应用需求攀升,倾向私有化部署,但面临诸多问题。国内首部AI大模型私有化部署标准《人工智能大模型私有化部署技术实施与评价指南》立项,正征集起草单位和个人。

PaperAgent
算法论文8

AlphaGo之父找到创造强化学习算法新方法:让AI自己设计

谷歌DeepMind团队在Nature发表论文,探索AI自主发现强化学习算法的可能。团队负责人是“AlphaGo之父”David Silver 。方法是基于智能体经验元学习,实验显示自动发现的规则表现优异,未来强化学习算法或无需人工设计。

机器之心
新闻资讯8

Yann LeCun最新纪录片首曝!传奇AI教父的双面人生,深度学习幕后40年

Yann LeCun新纪录片上线,回顾其深度学习四十年历程。他是深度学习开创者、Meta首席AI科学家,坚信机器应学会学习,认为AI竞争是开放与封闭之争,还对AI威胁论持务实乐观态度。

新智元
新闻资讯7

全国首部AI大模型私有化部署标准,公开征集起草单位和个人!

近期AI领域政策频出,企业对人工智能应用需求攀升,倾向私有化部署,但行业存在技术错配等问题。国内首部针对AI大模型私有化部署的标准《人工智能大模型私有化部署技术实施与评价指南》立项,正征集起草单位和个人。

CourseAI