RL训练方法」共找到 3361 篇相关文章

新闻资讯8

具身Scaling Law押对了!独角兽新品1小时学会新任务,重复1800次成功率99%

具身智能独角兽Generalist推出新模型Gen - 1,它在精细任务上表现出色,成功率大幅提升、效率加快,验证了机器人领域的Scaling Law。研发团队重写数据处理架构,采用新技术提升性能。

量子位
新闻资讯8

第一视角效率超过真机,深度机智发布全球首个以人类学习范式构建的具身基座模型

2026年具身智能行业火热,但技术路线不明。深度机智创始人陈凯在中关村论坛发布具身智能基座模型PhysBrain 1.0,用千余小时人类第一视角数据超越真机数万小时数据成果,开启具身领域‘物理常识’革命。

AI科技评论
算法论文8

CVPR 2026 | BiMotion:用 B 样条曲线重新定义 3D 角色运动生成

爱丁堡大学等团队提出 BiMotion 框架,将在 CVPR 2026 发表。它用 B 样条曲线表达运动,解决现有方法问题,有独特架构和损失函数,实验表现优,代码和数据集已开源。

机器之心
产品应用7

Tailwind CSS 的核心设计师彻底抛弃 Figma,把Claude Code 变为主力设计工具

Tailwind CSS 核心设计师 Steve Schoger 用 Claude Code 做设计一个月,体验惊艳。他复盘了用其构建营销网站过程,还总结出设计细节处理方法,此外他正参与开发 UI.sh 工具。

AI寒武纪
开源动态8

OpenAI用8个Skill把工程师的经验变成AI的工作手册:扛起两个SDK,3个月457个PR

OpenAI公开用Codex + Skills维护Agents SDK开源项目的方法论。通过AGENTS.md、Skills和GitHub Actions配合,将重复性工作自动化,PR吞吐量涨45%。还介绍了Skill设计、规则设定、测试策略等,且方案组件已开放。

AGI Hunt
算法论文8

李飞飞团队新作:简单调整生成顺序,大幅提升像素级图像生成质量

长期以来,AI生图面临潜空间模型细节损耗、像素空间模型结构混乱速度慢的矛盾。李飞飞团队最新论文提出Latent Forcing方法,通过重排生成轨迹,让像素扩散模型找回效率并刷新SOTA。

量子位
产品应用7

全网最详细的Codex入门教程,手把手教你玩转Vibe Coding。

本文是Codex入门教程,介绍其为OpenAI对标Claude code的编程应用,搭配GPT - 5.3 - codex模型。它速度快、额度高、能力强,适合编程小白,还讲解了下载、使用、功能配置等内容。

数字生命卡兹克
开源动态7

浏览器秒变 Mac 终端,有点意思!

介绍开源工具 VibeTunnel,它能把浏览器变 Mac 终端,支持远程操控。零配置、跨设备、实时同步,无需 SSH 密钥等。有跨设备访问等多种特性,给出不同系统安装方法和使用步骤。

开源先锋
算法论文8

高效智能体的「幕后推手」是谁?一篇综述带你从记忆×工具学习×规划看透

随着大模型能力提升,业界关注智能体落地,而高效性是决定能否上线的‘硬’问题。论文梳理‘高效智能体’综述,从记忆、工具学习、规划三机制出发,还谈及基准评测、挑战与展望。

机器之心
开源动态8

多模态Qwen3-VL-Embedding开源&技术剖析

互联网内容多元,传统文本搜索引擎应对跨模态需求力不从心。阿里开源Qwen3-VL系列两大模型,Qwen3-VL-Embedding负责“海选”,Qwen3-VL-Reranker负责“决赛”,技术亮点多,实验表现优异。

PaperAgent