智能体训练」共找到 5155 篇相关文章

算法论文7

谷歌研究院探索多智能协调的扩展原则

谷歌研究院对180种智能配置对照评估,得出‘AI智能系统首批定量扩展原则’。发现多智能协同效果因任务而异,还指出工具使用瓶颈等问题,且开发预测模型辅助架构选择。

InfoQ
新闻资讯7

xAI解散,但Grok还在上新,马斯克官宣新模型

xAI 解散、大批成员离职后,马斯克透露 Grok 最新模型进展,参数量 1.5T 的 Grok V9 - Medium 已完成训练,预计两到三周内发布。他还宣布现有 0.5T 模型年底前开源,此外首款编码智能 Grok Build 也备受关注。

机器之心
新闻资讯8

Karpathy新思考:别把AI当动物,它们是全新的智能物种

Andrej Karpathy发长推提出颠覆性观点,认为人们用错误框架理解AI,对比了动物智能与LLM智能的优化动力、根本差异等,强调优化目标决定智能形态,指出应按其机制对待AI。

AI工程化
算法论文7

MOE RL实战:统一FP8全流程训练

SGLang RL团队等联合完成工作,实现RL中全流程FP8训练与采样。介绍FP8训练硬件基础、格式、scale选择等,指出训练难点,分析KL Loss异常归因,验证其在MoE模型RL应用效果,还探究模型规模对训推不一致性的影响。

GiantPandaLLM
推荐文章8

真正的AI竞争力,藏在大模型“后训练”这一步

当全球聚焦基座模型参数竞赛时,后训练变革正悄然发生。产业共识是,大模型后训练是AI落地产业必经之路。后训练技术从SFT演进至强化学习范式,企业应用也有了从技术到商业价值的完整链路。

量子位
开源动态8

模型、代码、数据全开源!轻松训练自己的垂类Agent!

Together AI联合Agentica推出`DeepSWE-Preview`,基于开源Qwen模型,用RL在SWE - Bench - Verified登顶。团队将模型权重、训练框架等全开源,抛弃SFT纯用RL训练,还分享训练秘籍和TTS技巧,为垂类Agent训练提供新范本。

探索AGI
新闻资讯7

具身智能的终极命题:是造「人」还是造「生产力」?

华为开发者大会 2025 发布 CloudRobo 具身智能平台,为具身智能带来新视角。工业和商业场景实践显示,具身智能终极目标是锻造普适的「生产力引擎」,产业竞赛关键在于打造「群智能协同」。

机器之心
算法论文8

AMD新论文颠覆认知:FP4训练不稳定,原因不是随机性不足

大模型训练成本高,降低训练精度可降成本。AMD联合宾州州立大学论文颠覆认知,揭示FP4训练不稳定源于结构性微缩放误差,非随机性不足,还在原生FP4硬件完成大模型预训练

机器之心
开源动态7

开源版 Claude Cowork

Multica是原生桌面客户端,将编程智能能力带给大众,支持Claude Code等。它类似Obsidian,可按需定制,能解决编程智能使用障碍,具备简洁界面等特性,还介绍了使用、开发、构建等内容。

GitHubStore
产品应用7

不止是玩!有人利用Clawdbot组建了一个虚拟团队接管公司业务

AI智能客服公司SiteGPT创始人分享利用Clawdbot构建AI智能团队‘Mission Control’的经验。该团队含10个智能,可协同工作。系统有心跳机制控成本,还有协同平台,已产出多种成果。

AI工程化