联邦学习算法」共找到 1815 篇相关文章

开源动态8

清华开源一批「学习虾」,免费的「AI 私教团」来了

清华大学开源全球首个多智能体生成式学习AI技术框架OpenMAIC。它能将技术文档转化为学习课堂,还能解锁多种学习解法。其前身MAIC是重要学习平台,应用不断迭代,OpenMAIC功能强大,边界不止于课堂。

AI科技评论
算法论文8

北航,清华,北大联合发布: 异构智能体协同强化学习

北航、清华、北大联合发布异构智能体协同强化学习论文。提出 HACRL 新范式,实现异构智能体双向互学与独立部署统一;还有 HACPO 算法弥合智能体差异。实验显示性能提升且成本降低,为多智能体协同学习指明方向。

机器之心
开源动态8

给机器人一个会预测未来的Critic,VLA强化学习直接起飞

OpenMOSS团队开源的World Critic Model(WCM),解决了视觉 - 语言 - 动作模型强化学习(VLA - RL)中批评家模型(Critic Model)仅依赖单帧观测打分的问题。WCM让Critic学习预测执行动作后的潜在状态,代码等全开源,验证效果显著。

机器之心
开源动态8

12小时登顶OpenAI MLE-bench!上海AI Lab开源算法进化框架MLEvolve

上海AI实验室开源算法进化框架MLEvolve,12小时登顶OpenAI MLE - bench榜单第一。它是自进化机器学习系统,在75道Kaggle竞赛题上奖牌率达61.33%,为AI自主算法设计提供新方案。

量子位
算法论文8

强化学习的两个「大坑」,终于被两篇ICLR论文给解决了

现有强化学习算法基于理想化交互模式,难应对真实环境。Mila 实验室两篇 ICLR 2025 论文提出实时强化学习框架,分别解决推理延迟和动作缺失问题,还可结合使用,对关键领域意义重大。

机器之心
开源动态8

AI太难学?清华开源一批「学习虾」,免费的AI私教团来了

清华大学开源全球首个多智能体生成式学习AI技术框架OpenMAIC,它能将技术文档转化为零门槛学习课堂,还可解锁多种学习解法。其前身MAIC是重要学习平台,OpenMAIC功能强大,应用场景广泛。

CourseAI
新闻资讯7

语言模型内部还藏着众多策略模型?自底向上强化学习重塑底层特征 | 直播预约

现有强化学习工作将语言模型作整体策略优化,研究提出以策略视角审视内部隐藏状态,分析层级和模块级策略,发现不同模型模式差异,还提出自底向上强化学习策略,为研究架起新桥梁。

深度学习自然语言处理
开源动态7

刚刚,马斯克开源基于 Grok 的 X 推荐算法!专家:ROI 过低,其它平台不一定跟

马斯克时隔近三年再次开源X推荐算法,该算法基于Grok,采用端到端学习预测用户兴趣。不过有争议认为这或是因现实压力。专家称其ROI低,其他平台不一定跟进,且此次开源对学术研究价值不大。

AI前线
算法论文8

ICML26 | 浙江理工大学马啸讲师和南京大学李武军教授课题组联合提出EMCES:为强化学习合成更有价值的样本

强化学习获取高质量样本成本高、风险大,现有基于扩散模型的样本增强方法有局限。浙江理工大学马啸讲师和南京大学李武军教授课题组提出 EMCES,将情景记忆机制引入可控扩散模型,提升下游强化学习算法表现,论文已被 ICML2026 录用。

机器之心
算法论文7

逆强化学习全新视角的大模型对齐技术

文章从逆强化学习(IRL)视角回顾LLM对齐进展。先介绍强化学习基础及挑战,将LLM生成过程化为MDP,探讨无奖励函数的MDP,说明需神经奖励模型,还阐述通过奖励建模实现IRL及多种优化方法。

PaperAgent