「多智能体推理能力」共找到 6963 篇相关文章
均值至上假繁荣!北大新作专挑难题,逼出AI模型真本事
当强化学习成大模型后训练核心工具,主流方法陷入「均值优化陷阱」,推理能力停滞。北大团队提出RiskPO,将风险规避理念融入优化目标,用MVaR+捆绑策略双管齐下,三大任务表现优异。
刚刚,OpenAI 再次开源!安全分类模型 gpt-oss-safeguard 准确率超越 GPT-5
OpenAI 开源安全分类推理模型 gpt-oss-safeguard,有 120b 和 20b 参数量版本,采用 Apache 2.0 许可证。它能直接理解策略文档分类内容,推理能力超 GPT - 5,性价比高,虽有局限但仍是开发者利器。
估值315亿!田渊栋AI创业,谷歌、英伟达和AMD参投
Meta离职的田渊栋官宣创业,成立RSI,获6.5亿美元融资,估值约316亿。8位联创阵容豪华,团队致力于构建开放式架构,让智能体自主学习升级,目标打造具5万博士能力的智能系统。
ICML 2025|多模态理解与生成最新进展:港科联合SnapResearch发布ThinkDiff,为扩散模型装上大脑
现有扩散模型缺乏多模态推理创作能力,在算力和数据不充裕时实现该功能是难题。ICML2025上,港科联合SnapResearch提出ThinkDiff,以较少资源让扩散模型有思考能力,开辟多模态理解生成新路径。
字节Seed开源长线记忆多模态Agent,像人一样能听会看
字节Seed发布全新多模态智能体框架M3 - Agent,能听会看、有长期记忆且免费开源。团队还开发新长视频问答基准M3 - Bench并开源。实验显示,M3 - Agent在多基准测试中显著优于基线模型。
AI邪修时刻!Meta联手MIT投毒,左脚踩右脚强行升天
Meta的SOAR架构用错误率高的数据让模型推理能力暴涨9.3%。它选难题子集,用‘教师模型’生成含错题的‘垫脚石问题’,通过‘双层博弈’和‘有根奖励’机制让模型进步,或成AI进化新方向。
11 年前的那张图,又火了
一张2015年关于AI的智能曲线图近日在X上刷屏,马斯克也进行了转发。该图作者Tim Urban将AI分为ANI、AGI、ASI三个层级,指出人类习惯线性思考,但AI进步是指数级的。如今AI发展加速,其能力边界不断扩张。
基于文本AI的终结?Agent协作可直接「复制思维」,Token效率暴涨
在 Agentic AI 时代,多智能体系统让 AI 从单打独斗变为团队协作。普林斯顿大学等机构研究者提出多智能体推理框架 LatentMAS,将协作从 token 空间转移到潜在空间,实验显示其性能、效率大幅提升。
AI玩具和AI眼镜爆火,端侧市场或将超越云端?
当下AI难形成商业闭环,端侧AI或为落地答案。芯原股份戴伟民看好端侧AI市场,认为未来端侧推理需求或超云端训练,还指出AI眼镜、玩具、智能汽车等增量市场,同时介绍了芯原布局。
大模型Agent的下一阶段:可自我进化的AI-Agent
在人工智能飞速发展下,研究者探索让AI自我反思改进。本文作者构建自我进化AI智能体系统,设计四层渐进式架构,经《卡坦岛》实验,证明自我进化能力,不同模型表现有差异,代码级进化潜力惊人。