科学机器学习」共找到 1817 篇相关文章

新闻资讯7

0人类数据,让机器臂自学拧灯泡:MIT初创要打造机器人界的AlphaZero

Eka Robotics 发布机械臂视频,其能自主拧灯泡、抓取物品。该公司提出 VFA 模型,不依赖人类数据,让机器人在仿真环境自主探索。创始人期望实现超人级灵巧操作,算法还展现泛化和自主发明策略能力。

DeepTech深科技
新闻资讯7

2050大会 | 「AGI4Science·新生论坛——正在生长的科学地图 」嘉宾阵容全览!

2026年4月25日上午9点,2050大会将迎来“AGI4Science·新生论坛”专场。该论坛由王婷召集,以“三幕剧”展现AI for Science从理论到产业的图景,涵盖多领域,17位专家将探讨AI4S的生长与变革。

深度学习自然语言处理
新闻资讯8

2050大会「AGI4Science·新生论坛——正在生长的科学地图 」嘉宾阵容全览!

2026年4月25日上午9点,2050大会将举办“AGI4Science·新生论坛”。论坛由王婷召集,以“三幕剧”展现AI4S从理论到产业的前沿图景。涵盖多领域,17位专家探讨AI4S生长变革,涉及聚变商用、芯片设计等议题。

AI科技评论
开源动态8

VinciCoder:多模态统一代码生成框架和视觉反馈强化学习,数据代码模型权重已开源

中科院与美团团队推出 VinciCoder,打破多模态代码生成中 SFT 范式瓶颈。它将奖励机制转向视觉域,通过两阶段策略统一多样化代码生成任务,在多基准测试中表现卓越,为领域研究提供新范式。

机器之心
开源动态8

全新合成框架SOTA:强化学习当引擎,任务合成当燃料,蚂蚁港大联合出品

蚂蚁通用人工智能中心自然语言组联合香港大学自然语言组推出PromptCoT 2.0,押注任务合成。它让30B - A3B模型在数学代码推理任务达SOTA,全面升级效果、数据和方法,还将考虑多方向发展。

量子位
开源动态8

社区供稿丨如何抑制大模型的“过度反思”:Yuan3.0 Flash 中的强化学习范式

大模型在企业落地时存在“过度反思”问题,浪费算力。YuanLab.ai团队在Yuan3.0 Flash模型中提出RIRM与RAPO,前者奖励“思考过程”,后者优化训练框架,实现推理效率提升,适用于企业场景。

Hugging Face
算法论文8

极简主义的胜利:清华团队用最简单的强化学习配方刷新1.5B模型纪录

清华、伊利诺伊大学和上海AI实验室团队提出JustRL架构,仅用单阶段训练和固定超参数,在1.5B模型上刷新性能纪录,计算量仅为复杂方法50%,挑战了复杂技术堆叠现状。

AIGC开放社区
算法论文8

陈丹琦新作:大模型强化学习的第三条路,8B小模型超越GPT-4o

陈丹琦团队提出结合RLHF和RLVR优点的RLMT方法,支持在基础模型上直接使用,节省后训练成本。它让模型生成CoT,用奖励模型评价输出,使小模型超越大模型,推理更像人类。

量子位
算法论文8

中国科学PMA|西工大张伟伟、索玮、宋家豪、曹文博:PINNs的局限性讨论与微分方程智能求解展望

物理信息神经网络(PINNs)是求解偏微分方程的热点方法,有统一处理正、反问题等优点,但也存在求解精度低、普适性差等局限。文章剖析其失效根源,展望了改进方向,为构建微分方程智能求解框架提供参考。

力学与人工智能
开源动态8

突破全模态AI理解边界:引入上下文强化学习,赋能全模态模型“意图”推理新高度

在多模态大语言模型应用多元的当下,对模型理解人类意图需求迫切。阿里巴巴通义实验室团队推出HumanOmniV2,解决现有推理路径问题,其相关代码等开源,在多基准数据集成果突破性领先。

量子位