学习体系」共找到 1946 篇相关文章

新闻资讯8

强化学习之父Richard Sutton:人类数据耗尽,AI正在进入“经验时代”!

强化学习之父Richard Sutton在演讲中指出,人类数据耗尽,AI正进入“经验时代”,真正的AI要从与世界互动的“经验”中获取数据。他还认为创造超级智能体是好事,人类和AI繁荣应基于“去中心化合作”。

AI科技大本营
开源动态8

RL缩放王炸!DeepSWE开源AI Agent登顶榜首,训练方法、权重大公开

今天凌晨,Together.ai联合Agentica开源AI Agent框架DeepSWE,基于Qwen3 - 32B模型用强化学习训练。所有内容开源,测试中性能超所有开源Agent框架,证明强化学习训练潜力。

AIGC开放社区
算法论文8

西工大张伟伟等:强化学习如何练就近距空战制胜法则?| 航空学报CJA

本文针对空战智能化需求,构建高保真近距对抗仿真平台,提出优化自博弈强化学习架构。该智能决策系统与成熟飞行员近距格斗胜率超75%,为智能空战发展提供技术支撑。

力学与人工智能
新闻资讯8

从Foundation Model到Physical AI,三星「杀入」大模型核心战场

三星正快速进入大模型核心战场,构建Foundation Model体系,采购GPU用于AI基建。它提出Meki架构、M2RL训练范式和LiveClawBench评测体系,由AI Model TF团队推进,负责人是唐业辉。

机器之心
开源动态7

量化投资和金融科技的开源利器来了!

金融强化学习 (FinRL®) 是首个面向金融强化学习的开源框架,已发展成生态系统,有三层结构。其特点包括支持多算法、多市场环境模拟等,有完整流水线,还支持多数据源。

GitHubStore
新闻资讯8

AI教父Hinton诺奖演讲首登顶刊!拒绝公式,让全场秒懂「玻尔兹曼机」

2024年12月8日,诺贝尔物理学奖得主Hinton发表《玻尔兹曼机》演讲,内容于8月25日登APS期刊。他介绍‘霍普菲尔德网络’,分享创新应用,提出‘玻尔兹曼机学习算法’,后有受限玻尔兹曼机等成果,‘玻尔兹曼机’曾催化深度学习革命。

新智元
算法论文8

机器人高层指挥低层做,“坐标系转移接口”一次演示实现泛化学习 | ICML2025

美国东北大学和波士顿动力RAI提出HEP框架,首创“坐标系转移接口”,有极简高效分层结构、空间对称性自然泛化、创新型体素编码器等亮点。它基于分层策略和接口,提升机器人操作灵活性与泛化性,论文被ICML2025收录。

量子位
算法论文8

VDC+VBench双榜第一!强化学习打磨的国产视频大模型,超越Sora、Pika

复旦大学等机构将强化学习引入视频生成领域。提出的Cockatiel方法在VDC榜单夺冠,IPO方法在VBench登顶,超越Sora、Pika等模型,优化后视频生成效果在多方面显著提升。

机器之心
推荐文章8

Data Agent 落地挑战:忽略技术框架、语义能力和运营体系,投入可能打水漂

Data Agent 看似易上手,落地却充满挑战。腾讯数据工程专家虎兴龙指出,90% 难点源于软件工程,统一语义层建设是关键。企业若忽略相关要点,投入或打水漂,掌握关键要素可提升数据智能化效率。

InfoQ
算法论文7

UniSteer用机械臂「拼豆」:让人类指导进入VLA噪声空间强化学习

视觉 - 语言 - 动作模型(VLA)是机器人操作重要基础模型,但复杂任务成功率低,真机强化学习成本高。微软等机构研究者提出 UniSteer,将人类纠正转换成噪声监督,在多任务测试中提升了成功率。

机器之心