「分层多智能体框架」共找到 4697 篇相关文章
OpenAI新模型GPT-5.1发布,不跑分不刷榜,主打一个说人话
OpenAI发布GPT-5.1,主打更智能、更具对话性,无跑分打榜,有人设说人话。包括Instant和Thinking两个子模型,简单问题快,复杂问题智能。本周逐步向用户免费开放,还更新了语气风格等功能。
61.3%!「人类最后一场考试」AI终于及格了,揭秘Agent自我进化新路径
上海交通大学等联合团队提出MemRL框架,在不微调模型参数下,让AI在“人类最后一场考试”中准确率跃至61.3%。该框架受人类认知科学启发,解耦推理与记忆,实验表现出色,或为AGI提供高效路径。
AI 编程带来的新变革
作者分享在 Amazon Bedrock 用 AI 智能体写代码的项目经验,指出人与智能体协作使代码产出率大幅提升,但也带来 Bug 增多、CICD 管线阻塞、沟通成本增加等挑战,需重新思考软件开发方式。
当大模型陷入幻觉循环,如何用工程化给它“立规矩”?
普林斯顿和伯克利研究定义“机器胡扯”,指出大模型胡扯问题。蚂蚁集团旗下蚂蚁密算在2025 WAIC提出高阶程序(HOP)框架,为大模型注入规则,还开源此框架,其在多行业场景应用效果良好。
别被室内基准高分骗了:大模型是在推理空间,还是在「背答案」?
2025年,空间智能成大模型竞争新热点,模型在室内基准上分数飙升。但因训练与测试数据同源,其提升或只是“背答案”。中科院大学等机构发布OSI - Bench重新审视大模型空间能力,评测显示当前提升可能是虚假繁荣。
MotlBot作者被Claude刁难后:MiniMax M2.1是最优秀的开源模型
Moltbot热度不减,开发者挖掘其实用价值,阿里云、腾讯云上线相关云服务。Moltbot作者Peter接受采访,分享项目起源、开发思路等,认为MiniMax M2.1是优秀开源模型,还探讨了智能体发展及项目后续规划。
中国AGI深度时刻!杨强、唐杰、林俊旸、姚顺雨大咖们2026开年重磅交锋
2025年中国开源模型表现出色,AI大模型探索新范式。AGI - Next前沿峰会嘉宾探讨AGI发展,指出大模型To C与To B市场逻辑分化,还谈及自主进化、智能体变革及中国AI发展路径等问题。
9 个加速开发者生产力的开源 AI 与 MCP 项目
Github官方精选9个开源项目,分框架与平台集成、开发者体验及AI增强编码、自动化与测试编排三大主题。各项目聚焦不同功能,如将MCP嵌入框架、语义理解辅助编码、安全执行调试等,能加速开发者生产力。
Anthropic:这样构建Agent,性能提升90%!
Anthropic分享从0到1构建多智能体DeepResearch系统的方法,该系统是Claude内置Research功能。干货多,涵盖架构设计、Prompt工程等。多智能体性能比单模型高90.2%,但烧钱,适合高价值复杂任务。
AI开始替人类调用AI!token用量已是人类5.2倍
据OpenRouter统计,截至8月10日,Agent类token用量半年涨14倍,人类仅2.8倍。差距源于用法差异,虽智能体部分token计价低,但用量大仍烧钱。省钱关键在配套,且智能体任务验收缺人手。