「代码强化学习」共找到 3001 篇相关文章
人手数据,如何重塑机器人基础模型?专访 LaST-HD 一作刘家铭
本文是对 LaST-HD 一作刘家铭的专访。围绕数据路线之争,刘家铭分享交付背后的技术问题,也谈了对具身领域模型与数据发展方向的判断。他认为 Human Data 与真机数据非替代关系,VLA 和世界模型可共存。
Karpathy投了一家AI记忆公司,撞名DeepSeek Engram记忆架构
新公司Engram完成9800万美元融资,投资人有Andrej Karpathy等。它想为AI构建能持续学习的“记忆层”,解决模型吸收组织内部知识问题,首个产品是面向Agent的API,已与多家合作。
一夜之间,Claude成我同事了
今天凌晨,Claude Code 迎来重磅更新 Claude Tag,可让 Claude 以团队成员身份加入用户团队,在 Slack 平台使用。它具备持续记忆、主动介入等能力,有多人共享、持续学习等优势,企业客户可试用。
实测 Seed 2.1 Pro:从零到一,开源一个大学生就业补贴的公益网站
火山引擎在 Force 大会发布豆包大模型 Seed 2.1 Pro 系列,API 上线火山方舟。作者实测用其完成大学生就业补贴政策网站开源项目,展示模型 Coding 和 Agent 能力,还提及性能、成本等优势及后续计划。
从 Serverless 到 Agent:Cube 系统的一些设计思考
本文从 Serverless 面临的挑战出发,介绍 Cube 系统设计,包括分布式调度、资源池化等。还探讨其在 Agent 场景应用,如极速代码执行、高并发 Agentic RL 等,最后展望向行业开源,助力 Agent Infra 发展。
谷歌辞职、创业失败、重读神经科学,她说 AI 时代最危险的事是外包你的思考 | 万有引力
本文是对神经科学家 Anne - Laure Le Cunff 的采访。她分享谷歌工作、创业失败后转读神经科学的经历,阐述“小实验”理念,对比“小目标”,给出 PACT 框架,还谈 AI 使用、科技焦虑等问题。
估值315亿!田渊栋AI创业,谷歌、英伟达和AMD参投
Meta离职的田渊栋官宣创业,成立RSI,获6.5亿美元融资,估值约316亿。8位联创阵容豪华,团队致力于构建开放式架构,让智能体自主学习升级,目标打造具5万博士能力的智能系统。
对话关梦龙:他想用 Agent 拯救你手机里的 100G 废片
前字节跳动剪映早期成员关梦龙,正开发AI编导产品“Cutto”,让AI参与内容生成,降低普通人创作门槛。他认为AI虽提升生产力,但创业竞争更激烈,产品成功需看用户能否持续使用。
揭秘与评测 30K+ Star 的 Graphify:企业存量系统 AI 编码的"第二大脑"。
文章揭秘评测 30K+ Star 的 Graphify,它能将分散材料转为结构化知识图谱,助 AI 编程助手理解代码。介绍其使用方法、原理,经测试它能提升综合质量、降低探索成本,不过并非万能解药。
9.8K Star!谷歌开源神器 OSV-Scanner,一条命令扫出所有依赖漏洞!
文章介绍谷歌开源的轻量级命令行工具 OSV - Scanner,它能扫描项目依赖中的已知安全漏洞,连接项目依赖与 OSV.dev 数据库。支持多语言、多包管理器,有多种功能,可离线使用,还能提供修复建议和许可证扫描。