RL训练方法」共找到 3361 篇相关文章

推荐文章8

AI编程的下半场来了?学会用Agent Skill解决编程的痛点问题

文章分享用 Agent Skill 解决 AI Coding 痛点的实操复盘,如让代码上线、解决 AI 不用 Skill 问题。介绍 Skills 原理、CloudBase Skills 优势及与 MCP 组合,还给出实战案例、踩坑经验和未来规划。

腾讯技术工程
新闻资讯7

算力都去哪儿了?这个 Seedance 2.0 生成的梗视频给出了答案

有人用Seedance 2.0将Anakin and Padmé梗做成AI视频讽刺AI行业。视频对话暗示算力用途与宣称不符,最后几秒AI将帕德梅形象处理成擦边画风,揭示算力真实去向。

宝玉AI
开源动态7

OpenClaw太麻烦?没关系,你有这个项目可以一斑窥豹!

nanobot是受Clawdbot启发的超轻量级个人AI助手,仅约4000行代码,比Clawdbot小99%,有核心功能。它代码清晰、资源占用少、易部署,还介绍了安装、使用、配置等内容。

GitHubStore
开源动态8

华为开源7B多模态模型,视觉定位和OCR能力出色,你的昇腾端侧“新甜点”来了

华为推出开源多模态模型openPangu-VL-7B,适配昇腾端侧。它推理性能性价比高,在多核心任务表现突出,技术报告还披露核心技术细节,为昇腾使用者带来新选择,丰富昇腾生态。

量子位
算法论文8

复杂空间推理新SOTA,性能提升55%!中山大学新作SpatialDreamer

中山大学等机构推出SpatialDreamer,模拟人类空间认知过程,构建闭环推理流程,还提出GeoPO解决奖励稀疏问题,构建SpatialDreamer - SFT数据集。实验显示其在多基准达SOTA,为AI空间智能发展开辟新路径。

新智元
算法论文8

迎接「万物皆可RAG」时代:最新综述展示50多种多模态组合的巨大待探索空间

大模型常采用RAG技术,多模态崛起使RAG向MM - RAG发展。目前MM - RAG研究初级,华中科技大学等研究者发布综述,覆盖所有模态组合,剖析工作流,提供构建系统的一站式指南。

机器之心
推荐文章8

视觉生成的另一条路:Infinity 自回归架构的原理与实践

本文整理自字节跳动韩剑在AICon 2025北京站的分享,以Infinity为例介绍自回归视觉生成原理,对比其与扩散模型,展示Infinity升级方案成果,它在高分辨率文本到图像任务能与扩散模型竞争。

InfoQ
推荐文章7

JHU教授揭秘学术潜规则:普通博士如何打破鄙视链翻盘?

约翰霍普金斯助理教授Anand Bhattad用亲身经历,总结给博士生的硬核生存指南,揭秘学术潜规则,如出身门槛、指标焦虑等问题,并给出突围策略和主动方法

新智元
推荐文章8

YC总结的vibecoding核心指南「如何充分利用Vibecoding 」

顶尖孵化器 Y Combinator 总结了 vibecoding 核心指南,涵盖规划流程、版本控制、测试框架等多方面内容,为开发者提供了利用 AI 进行开发的实用策略和方法

AI寒武纪
开源动态8

2小时入门「个性化联邦学习」,上交清华开源斩获1700+星 | JMLR'25

上海交通大学和清华大学研究人员开源个性化联邦学习代码库PFLlib,含39种算法、3种场景和24个数据集,支持模拟500设备训练,还有隐私保护评估工具,降低研究门槛。

新智元