智能体训练」共找到 5155 篇相关文章

推荐文章7

智能时代的人月神话

作者 Wes McKinney 因 AI 打乱睡眠作息,在工程师圈子热烈讨论人类技术优势。他开发 RoboRev 工具,结合《人月神话》探讨软件工程未来,指出智能虽提升生产力,但面临本质复杂性、范围蔓延等问题,设计与品味仍至关重要。

InfoQ
算法论文8

成本降70%!清华、阿里通义带来智能长程任务新解法

AI智能处理长程任务常遇上下文超载问题。清华与阿里通义研究人员提出MemPO算法,赋予大模型主动管理记忆能力,准确率提升,计算资源消耗降近七成,不过评价机制有局限。

AIGC开放社区
开源动态8

补齐OpenClaw进化拼图!AReaL v1.0开源,智能强化学习「一键接入」

2026 年 Agent 仍是热门赛道,OpenClaw 热度持续。但 Agent 强化学习训练缺乏成熟系。蚂蚁和清华联合打造的 AReaL v1.0 开源,实现 Agent 一键接入 RL 训练,还革新了训练引擎,降低开发门槛。

机器之心
开源动态8

The Batch: 855 | 为智能而生

总部位于北京的 Moonshot AI 发布 1 万亿参数的 Kimi K2 系列大语言模型,包括预训练和微调版本。它输入输出能力强,架构独特,在多基准测试领先,支持工具调用,多家服务商已集成。

DeeplearningAI
新闻资讯7

智能力学青年学者论坛第二十六、二十七讲 | 国防科技大学陈新海、北京航空航天大学张天汉

智能力学青年学者论坛第二十六、二十七讲分别由国防科技大学陈新海、北京航空航天大学张天汉开讲。陈新海介绍智能网格生成研究进展,搭建科学计算智能平台;张天汉提出ChatCFD方法,提升CFD可及性。

力学与人工智能
算法论文7

Theory of Agent:构造知行合一的智能

当前AI(如ChatGPT)存在行为随机性、效率黑洞等问题,论文指出AI缺乏认知地基,需明确认知框架。还提出革命性等式“推理 = 行动”,分析了知识与决策边界,给出最优行为四象限,介绍落地路径和未来发展方向。

深度学习自然语言处理
推荐文章7

150%训练效率提升:感知检测小模型训练优化方法

文章基于业务实践,总结感知检测小模型在不同算力卡上的训练方法,为智能驾驶场景提供借鉴。介绍测试环境、技术架构,分析环境依赖冲突、源代码适配等问题并给出解决方法,还提及性能优化及测试结果。此外还介绍用 RAGFlow 构建私有知识问答应用。

阿里云开发者
算法论文8

大模型训练新突破!“不对称”训练让AI学会自我反思,推理零开销

字节团队提出全新语言模型训练方法PCL,首次打破训练与推理对称约束,实现‘训练-推理不对称’。在训练时让模型反思评估结果,推理时仅输出答案,零额外开销,显著提升模型能力。

量子位
开源动态8

统一20+多智能方法,MASLab震撼发布

由十机构联合推出的 MASLab,带来大模型多智能系统代码库,统一 20+主流 MAS 方法。有方法全、评估准、结构清晰特性,经大量实验刻画性能图谱,还提出新方法,且发起开源社区。

机器之心
开源动态8

5.1K Star!Codebuff 把整个 AI 编程团队装进你的终端!

Codebuff是开源AI编程助手,获超5.1k stars。其多智能架构让不同智能分工协作,理解代码上下文更好、编辑更准。官方测试中完成率61%,超Claude Code。它免费且上手简单,还能创建自定义智能

开源星探