学习范式」共找到 2159 篇相关文章

开源动态7

量化投资和金融科技的开源利器来了!

金融强化学习 (FinRL®) 是首个面向金融强化学习的开源框架,已发展成生态系统,有三层结构。其特点包括支持多算法、多市场环境模拟等,有完整流水线,还支持多数据源。

GitHubStore
新闻资讯8

AI教父Hinton诺奖演讲首登顶刊!拒绝公式,让全场秒懂「玻尔兹曼机」

2024年12月8日,诺贝尔物理学奖得主Hinton发表《玻尔兹曼机》演讲,内容于8月25日登APS期刊。他介绍‘霍普菲尔德网络’,分享创新应用,提出‘玻尔兹曼机学习算法’,后有受限玻尔兹曼机等成果,‘玻尔兹曼机’曾催化深度学习革命。

新智元
算法论文8

NeurIPS 25 | GRPO进阶版来了,GVPO重构大模型后训练范式

大模型后训练越发关键,GRPO 有缺陷。作业帮与香港科技大学(广州)团队在 NeurIPS 2025 提出 GVPO 方法,解决 GRPO 稳定性难题,理论有最优解保证,实验表现超现有方法。

机器之心
算法论文8

机器人高层指挥低层做,“坐标系转移接口”一次演示实现泛化学习 | ICML2025

美国东北大学和波士顿动力RAI提出HEP框架,首创“坐标系转移接口”,有极简高效分层结构、空间对称性自然泛化、创新型体素编码器等亮点。它基于分层策略和接口,提升机器人操作灵活性与泛化性,论文被ICML2025收录。

量子位
算法论文8

VDC+VBench双榜第一!强化学习打磨的国产视频大模型,超越Sora、Pika

复旦大学等机构将强化学习引入视频生成领域。提出的Cockatiel方法在VDC榜单夺冠,IPO方法在VBench登顶,超越Sora、Pika等模型,优化后视频生成效果在多方面显著提升。

机器之心
算法论文7

ICCV2025 | 多视图生成新范式-利用自回归模型探索多视图生成

本文介绍自回归生成多视图图像方法 MVAR,能从先前视图提取引导信息增强一致性,拉近与基于扩散方法的图像质量差距。解决了多模态条件控制和数据有限问题,展示出强指令遵从与多视角一致性。

机器之心
产品应用8

AI 原生设备爆发,操作系统迎来更智慧、更流畅、更安全的范式革命

AI原生设备爆发,传统操作系统面临挑战,将迎来范式革命。vivo蓝河操作系统3(BlueOS 3)全栈自研,具备“天生更智慧、更流畅、更安全”特质,本文以此为例解读操作系统架构重塑。

InfoQ
推荐文章7

生成式推荐!推荐系统新范式还是新噱头?【文末抽现金红包】

文章探讨生成式推荐是新范式还是噱头。分析其与判别式推荐区别、效果收益来源,结合Meta GR、快手OneRec实例,指出其有提升但非万能,不同团队应按需选择,还提及可能带来架构革新。

王喆的AI笔记
算法论文8

Vision-Zero:零数据VLM自我进化!陈怡然团队提出零监督训练新范式

陈怡然团队提出零监督训练新范式Vision-Zero,在多模态任务表现突出。它借鉴自博弈技术,设计自博弈框架,解决数据稀缺和知识天花板问题,还缓解跨能力负迁移,开源代码与模型可供研究。

机器之心
算法论文7

UniSteer用机械臂「拼豆」:让人类指导进入VLA噪声空间强化学习

视觉 - 语言 - 动作模型(VLA)是机器人操作重要基础模型,但复杂任务成功率低,真机强化学习成本高。微软等机构研究者提出 UniSteer,将人类纠正转换成噪声监督,在多任务测试中提升了成功率。

机器之心