生成式强化学习」共找到 3479 篇相关文章

算法论文8

ICLR 2026 | ESC — 解构一步生成,厘清细节,探寻本质

西湖大学研究人员针对一步扩散生成模型复杂性问题,提出统一设计框架,对代表性模型进行组件级分析,定位关键误差来源,提出ESC变体,在ImageNet 256×256上取得优异成果。

机器之心
产品应用7

Gemini 的 PPT 生成:使用技巧及模板提示词

Gemini APP 上线 PPT 生成能力,可通过提示词精细控制,还能与谷歌产品打通。文章介绍其使用方法,如开启 Canvas 模式、利用搜索填充内容等,还分享百搭 PPT 风格提示词。

歸藏的AI工具箱
算法论文8

混合数学编程逻辑数据,一次性提升AI多领域强化学习能力 | 上海AI Lab

上海AI Lab的OpenDataLab团队通过大规模实验剖析RLVR在多领域推理机制。构建多领域评估框架与定制奖励策略,基于Qwen2.5 - 7B系列模型联合训练,有多项关键发现,为构建AI推理模型提供参考。

量子位
推荐文章7

生成式推荐!推荐系统新范式还是新噱头?

文章围绕生成式推荐展开,介绍其概念,探讨效果和成本问题。以Meta的GR和快手的OneRec为例,分析收益与开销,指出不同团队应用情况,认为它或带来架构革新,也提醒勿盲目跟风。

王喆的机器学习笔记
产品应用7

简单快速的用 Claude Code 帮你创建 PPT 生成 Skills

Claude Code热度高,其Skills可辅助构建简单Agent。作者以创建Nano Banana PPT生成Skills为例,教大家安装、使用及创建Skills,还提及Skills迭代和局限性等内容。

歸藏的AI工具箱
开源动态8

Lumina-DiMOO:多模态扩散语言模型重塑图像生成与理解

上海人工智能实验室推出多模态扩散语言模型 Lumina - DiMOO,它基于离散扩散建模,打破多模态任务壁垒。相比传统自回归架构模型,它解决了生成慢、质量受限等问题,在多项评测中夺魁。

机器之心
开源动态8

全新合成框架SOTA:强化学习当引擎,任务合成当燃料,蚂蚁港大联合出品

蚂蚁通用人工智能中心自然语言组联合香港大学自然语言组推出PromptCoT 2.0,押注任务合成。它让30B - A3B模型在数学代码推理任务达SOTA,全面升级效果、数据和方法,还将考虑多方向发展。

量子位
算法论文8

合成数据≠生成模型:一文读懂合成数据的全新范式

最新研究提出合成数据全新分类框架,突破‘生成模型=合成数据’传统认知,涵盖多种方法。还按应用层次划分场景,指出合成数据面临模型坍塌等挑战,正成新型基础设施。

新智元
算法论文7

可解释性杀疯了!结合机器学习,发顶会轻轻松松!

在机器学习领域,模型可解释性愈发重要。结合XAI技术能提升模型透明度与可信度,如预测儿童饮食多样性、心血管疾病分类准确率很高。还整理9篇相关论文,解析两篇文章创新点、方法和结论。

机器学习AI算法工程
开源动态8

效果非常不错!阿里昨开源图形海报生成模型Qwen-Image

阿里昨日开源多模态图像基础模型Qwen-Image,基于20B参数MMDiT架构,在复杂文本渲染和精确图像编辑方面有重大突破,支持多风格图像生成、智能图像编辑等,还介绍了使用、部署等方法。

GitHubStore