智能体训练」共找到 5141 篇相关文章

开源动态8

OpenClaw 能“边用边训”了:智能强化学习训练框架 AReaL v1.0 稳定版发布

3月4日,蚂蚁集团联合清华发布开源强化学习训练框架AReaL v1.0稳定版,主打‘Agent一键接入RL训练’。它解决现有智能框架接入训练成本高、缺乏持续进化能力的问题,还推出原生训练引擎Archon,集成AI辅助开发系。

InfoQ
算法论文8

智能新范式Chain-of-Agents,多项任务新SOTA

论文提出Chain-of-Agents (CoA) 范式,结合多智能系统与工具集成推理优势。通过多智能蒸馏和智能强化学习训练智能基础模型(AFM),实验显示其在Web和Code任务上达新SOTA,效率、泛化性佳。

深度学习自然语言处理
开源动态8

卡帕西630行代码炸出81个智能,4天协作跑2333次实验,公布预训练十大发现

Karpathy的Autoresearch项目630行代码让AI自主实验,提升语言模型训练效率。全球开发者让多智能协作,智能自发形成同行评审制度。项目发起者公布十大发现,还衍生出表现出色的auto - discovery项目。

量子位
产品应用8

AI4S智能「井喷」,这个智能登顶多项评测榜单,实现产业落地

2026年是AI4S「智能元年」,科研智能产品密集发布,行业关注转向产品落地。深度原理发布的AI科学家平台Mira在多项评测中领先,其全链路闭环系统补齐传统短板,已在多领域落地验证。

机器之心
开源动态8

华为推出软工代码智能SWE-Lego,解锁SFT训练极致性能

华为研究团队推出仅基于监督微调(SFT)的软件工程代码智能SWE-Lego,无需复杂RL流程,在SWE-bench Verified基准中表现出色,项目已开源。它有数据、训练和测试时扩展三大创新。

机器之心
算法论文7

广义智能理论:智能时代通向「万物理论」的新路径?

源自AI的「广义智能理论」为探索「万物理论」提供新视角。它将物理、生命、AI系统纳入标准智能框架,提出四大基本作用力或源于「智能场」,还为经典、相对、量子力学差异提供新诠释。

新智元
产品应用8

字节发布通用游戏智能!5000亿token训练,用鼠标键盘吊打GPT-5!

字节seed团队打造通用游戏智能Game-TARS,基于键盘—鼠标动作空间训练,用超5000亿标注量级数据,结合新技术提升扩展性和泛化性,在多类游戏任务中表现超越GPT - 5等模型。

量子位
产品应用8

用DAA衡量智能 百度智能云用“新全栈”重新定义AI云|甲子光年

2026年产业焦点转向智能落地,李彦宏提出DAA概念。百度智能云升级为新全栈AI云,解决智能落地难题,从架构决策、行业应用等多方面发力,其价值值得市场重估。

甲子光年
新闻资讯8

从OpenAI回国的90后姚班博导,打造了国内首个开源Agent训练框架:从OpenAI团队解散与重组,看智能十年沉淀

本文讲述90后姚班博导吴翼的经历。他曾在OpenAI参与多智能研究,回国后投身学术与创业,打造国内首个开源Agent训练框架AReaL。他分享在OpenAI的经验,探讨创业、技术发展等问题。

InfoQ
推荐文章8

企业级 Agent 多智能架构与选型指南 -- 来自1000+行业应用实践积累

本文基于超1000+智能应用实践经验,介绍企业级Agent多智能架构。强调单智能优先,介绍AgentScope支持的多智能模式,对比工作流与对话模式,给出架构选型指南,还提及Spring AI Alibaba Graph为多智能提供的能力。

阿里云开发者