代码强化学习」共找到 2984 篇相关文章

算法论文8

谢赛宁REPA得到大幅改进,只需不到4行代码

Adobe Research等团队对REPA展开研究,发现驱动目标表征生成性能的是空间结构而非全局性能。基于此构建iREPA,代码不到4行,能提升REPA收敛速度,在多方面表现出色。

机器之心
算法论文7

可解释性杀疯了!结合机器学习,发顶会轻轻松松!

在机器学习领域,模型可解释性愈发重要。结合XAI技术能提升模型透明度与可信度,如预测儿童饮食多样性、心血管疾病分类准确率很高。还整理9篇相关论文,解析两篇文章创新点、方法和结论。

机器学习AI算法工程
算法论文8

文本分类重大创新:持续学习新增类别,不会灾难遗忘

在生成环境中,传统文本分类方法新增业务标签需从头训练,易致知识灾难性遗忘。今天介绍的自适应分类器,通过四项创新,可实现动态类添加和持续学习,而不会发生灾难性遗忘。

CourseAI
算法论文8

启发学习:让大模型认知从外化到内生

当下大模型能力多靠人为框架,能力上限受限。文章提出“启发学习”,将其集成到推理侧成Isaac框架,通过Prompt与网络层注入复用旧经验,实验显示能大幅提升大模型任务性能。

机器之心
产品应用8

Nano Banana官方提示词来了,附完整代码示例

Nano banana正火爆全球,谷歌推出官方提示词指南。文中展示其强大效果,如人物合照、生成动画视频、换脸等,还总结其5大核心功能,给出6类提示词及代码示例。

量子位
算法论文8

突破瓶颈,嵌入式AI神经持续学习引擎—Replay4NCL

阿联酋、纽约、巴基斯坦大学研究人员推出Replay4NCL,解决嵌入式AI持续学习难题。它优化记忆重放,有创新架构和训练策略。实验显示其精度高、延迟低、省内存、能耗少,成果将在2025年DAC大会展示。

AIGC开放社区
算法论文8

首个可学习姿态对齐的视频扩散模型!StableAnimator++

当前人像动画扩散模型在人物身份一致性上表现不佳,复旦大学联合多团队提出StableAnimator++,它是首个可学习姿态对齐的视频扩散模型,能生成自然保真的人物动画,还在保持人脸一致性上做了改进。

带你学AI
算法论文8

NeurIPS 2025 Spotlight | 条件表征学习:一步对齐表征与准则

文章指出传统表征学习处理图片和商品信息时存在局限,针对性有监督训练成本高,多模态大模型使用成本也需考虑。为此提出即插即用的条件表征学习方法 CRL,实验显示其在下游任务表现优异。

机器之心
新闻资讯7

Nano Banana爆火之后,一个神秘的「胡萝卜」代码模型又上线了

OpenAI草莓命名引发潮流,Recraft小熊猫、谷歌Nano Banana等跟进。现Anycoder平台出现神秘代码模型Carrot(胡萝卜),能力强,网友对其归属猜测不断。

机器之心
新闻资讯7

「10倍工程师」神话破灭?代码免费,懂品味才值钱

AI正将世界撕裂成「双重现实」,一边是疯狂用AI重构工作流的人,另一边是把AI当玩具的人。AI抬高了行业下限,让「10倍工程师」成新底线,写代码贬值,懂品味的研究值钱,且AI或先改造蓝领行业。

新智元