「多智能体强化学习」共找到 4565 篇相关文章
碾压DeepSeek V3!开源AI Agent专属模型,1万亿参数、工具使用能力超强
国内大模型平台月之暗面开源了模型Kimi - K2,这是混合专家模型,总参数1万亿。它针对AI Agent优化,工具使用能力强。测试显示其性能碾压DeepSeek V3等模型,训练流程还有独特技术创新。
SFT+RL双管齐下:ReasonGen-R1如何破解文生图「指令不遵」难题?
上海科技大学等机构提出 ReasonGen-R1 框架,结合链式推理监督微调与强化学习,提升自回归图像生成模型推理和创作能力,已全面开源。介绍了其训练阶段、实验结果及推理链模式。
1400亿Agent入场,“流量”这条护城河要塌了
在支付宝AI生态大会上,蚂蚁集团CEO韩歆毅提出Agent时代流量逻辑失效、信任逻辑崛起。他还指出人的流量让位于智能体生态,Agent重构商业决策权,AI支付将成全球新基建。
全球首个世界统一模型发布,机器人家庭成员来了!
自变量机器人发布全球首个世界统一模型架构的具身智能基础模型WALL - B,它打通视觉、听觉等模块,让机器人理解物理世界。还让机器人拥有多能力,通过真实家庭数据形成数据飞轮,助力其融入家庭。
AI真能搞钱了!这家公司把大模型玩成闭环赚钱机器
当全行业还在卷大模型参数、烧算力时,零犀科技走出不同路。其自研因果大模型,用AI智能体帮企业提升销售。2025年已实现规模盈利,成为最早跑通商业闭环的大模型应用公司。
Thin Harness, Fat Skills:AI工程架构的本质
文章介绍了AI工程架构本质,阐述Garry Tan倡导的智能体工程三原则,分析架构分层,包括Fat Skills、Fat Code和Thin Harness层,还通过案例展示技能文件进化特性,提及社区讨论、边界迁移和工程纪律价值。
Generalist最新长文定调:具身原生才是正道,中国玩家原力灵机已交卷
Generalist创始人Pete Florence团队释出GEN-1技术博客,否定世界模型与VLA之争,强调具身智能应回归目标,主张从零训练。中国原力灵机DM0也采用具身原生路线,在RoboChallenge评测中成绩优异。
一条被开发者踩出来的路:OpenClaw“涌进”飞书
在中文社区,越来越多开发者将 OpenClaw 接入飞书,飞书接口生态开放且更新快。这波热度并非官方推动,开发者先实践,后飞书将路径官方化,补齐链路,其优势在于便捷实用,正朝“入口级”智能平台转变。
走一步看一步、两三个月就迷茫一次:字节扣子的两年「创业」
字节的扣子刚完成大版本更新,定位“职场AI,就用扣子”。它过去两年像早期创业团队“野生”生长,从Bot Studio到工作流平台,再到扣子空间,如今迈向Vibe Coding,强化“伙伴”定位,值得产品创新者研究。
21岁MIT辍学,估值3亿美金!誓要自动化十亿小时办公
两个MIT辍学生创办AI合规初创公司Delve,成立半年获3200万美元融资,估值达3亿美元。他们用AI智能体解决企业合规痛点,目标是自动化十亿小时人类办公,虽有竞争,但凭借领域深度脱颖而出。