强化学习范式」共找到 2266 篇相关文章

推荐文章7

生成式推荐!推荐系统新范式还是新噱头?

文章围绕生成式推荐展开,介绍其概念,探讨效果和成本问题。以Meta的GR和快手的OneRec为例,分析收益与开销,指出不同团队应用情况,认为它或带来架构革新,也提醒勿盲目跟风。

王喆的机器学习笔记
新闻资讯8

ICML 2026前瞻:投稿翻倍背后,机器学习正在换挡

第43届国际机器学习大会(ICML 2026)7月6 - 11日将在韩国首尔举行,主题为‘Machine Learning for the Real World’。今年投稿量翻倍,接收率26.6%,还做了两项制度调整。论文反映出LLM推理、AI安全、模型压缩等趋势,中国研究者表现亮眼。

AI科技评论
算法论文8

破解「个性化学习」长尾难题,巧用神经坍缩理论 | ICML 2025

当前个性化学习方法基于数据高质量且类别平衡的假设,但现实教育数据呈不均衡分布。华东师范大学和浙江大学团队在ICML2025提出NCAL方法,将神经坍缩理论引入该领域,解决教育数据长尾分布问题。

新智元
算法论文8

GAG:超越RAG,无需检索的私有知识注入新范式

在高价值私有场景,主流大模型注入知识的路线各有硬伤。中科院和360AI联合团队提出GAG方案,无需检索、固定底座、单Token、即插即用,实验显示效果佳,也指出跨域组合等局限。

PaperAgent
产品应用8

刚刚,中国AI交卷!40年难题56分钟破局,AI不再「学习

文章介绍AI科研应用新趋势,从学习已知知识转向搜索未知解。以百度‘伐谋’为例,它助力南京林业大学检测松材线虫病,还在多学科和产业场景中展现价值,百度还启动科学家计划推动其发展。

新智元
开源动态7

【CUDA-MODE学习笔记】Lecture 40: CUDA Docs for Humans(文末送书

本文是CUDA-MODE课程笔记,介绍Modal公司GPU术语词汇表项目,讲师分享职业历程,强调理解CUDA技术栈各层次重要性,还讨论了项目短、中、长期目标,是助力开发者掌握CUDA的教育项目。

GiantPandaLLM
算法论文8

10%训练数据超越100%表现,机器人学习领域迎来重要突破

密歇根大学和瑞典皇家理工学院团队提出 ViSA - Flow 框架,能从人类视频提取语义动作流,提升机器人数据稀缺时学习效率。在 CALVIN 测试中,用 10% 训练数据超越 100% 数据方法,有技术优势也存在局限。

机器之心
开源动态8

蜂群Agent来了!openJiuwen社区发布JiuwenSwarm,引领Coordination Engineering新范式

华为支持的 openJiuwen 社区发布并开源 JiuwenSwarm,这是面向多智能体协作的蜂群智能体。它指向 Agent 工程新问题,将关注点从 Harness 引向 Coordination Engineering,还介绍了其设计理念、实战效果等。

InfoQ
算法论文8

扩散LLM推理新范式:打破生成长度限制,实现动态自适应调节

随着扩散大语言模型成为热门,但其推理时存在预设固定长度的限制。香港中文大学 MMLab 等提出 DAEDAL,赋予模型根据问题自主调整回答长度的能力,在性能和计算效率上有提升。

机器之心
算法论文8

北大、蚂蚁三个维度解构高效隐私保护机器学习:前沿进展+发展方向

北大李萌课题组与蚂蚁集团研究者共同完成综述,从协议、模型和系统三个维度梳理隐私保护机器学习(PPML)领域,指出当前痛点,给出优化策略,还提出跨层级协同优化方向。

机器之心