「多智能体技术」共找到 8146 篇相关文章
月耗3000美金的Skills重度用户,实测MiniMax M2.7:国产Agent模型的天花板?
AI产品黄叔作为月耗3000美金的Skills重度用户,实测MiniMax M2.7,从多Agent协作、Coding能力、办公自动化等多方面测试,发现其表现出色,虽有不足,但在多维度已是国产模型天花板。
阿里悟空全网首测
2026年OpenClaw引领AI Agent热潮,但对普通人不好用。阿里钉钉发布企业级AI原生工作平台悟空,预置多行业OPT套件,实测能完成设计等工作,解决OpenClaw部署和安全问题,且有阿里集团战略支持。
新研究重新评估 AGENTS.md 文件在 AI 编码中的价值
苏黎世联邦理工学院新论文指出,`AGENTS.md` 文件可能常阻碍 AI 编码智能体。研究构建 AGENTbench 数据集测试,发现 LLM 生成文件降低性能,人类编写文件有边际收益但也增加成本,开发人员对此研究看法不一。
特朗普刚下禁令,美军动用Claude空袭!军用版或已达Opus 5.5水平
WSJ报道,特朗普刚封杀Claude,美军就用其空袭伊朗。美军多司令部用Claude做情报评估等。Anthropic为军方定制版或达Opus 5.5水平。Anthropic曾因隐私等问题与五角大楼谈判破裂。
LeCun预言成真!790年长视频,炼出最强开源「世界模型」
2025年‘世界模型’成AI巨头战场,谷歌、李飞飞团队等纷纷布局。上周北京智源研究院发布Emu3.5,340亿参数,基于790年长视频数据训练,其架构优越,推理快,能力强,还公开技术报告邀全球探索。
刚拿诺奖就登Nature封面!谷歌“量子回声”算法计算提速13000倍,可重复验证结果
刚获诺奖的谷歌量子团队登Nature封面,提出“量子回声”算法,计算提速13000倍且结果可重复验证。解决了量子计算结果难确认问题,该算法在多领域有应用潜力,还依赖Willow芯片优势。
首个多轮LLM Router问世, Router-R1可让大模型学会「思考–路由–聚合」
在大语言模型种类爆炸的时代,如何智能分配任务成新挑战。伊利诺伊大学香槟分校团队发布 Router - R1,让 LLM 学会‘思考–路由–聚合’,用强化学习平衡性能与成本,在七大基准测试表现出色。
2025 智谱 Z DemoDay :24 家值得关注的 AI 创企,看看今年创业都在做什么?
8月31日,星连资本、智谱Z计划主办的Z DemoDay举办,24个早期AI项目亮相,覆盖多领域。路演外还有产品创造营,围绕AI产品设计研讨演练。大会还设创意活动,揭示AI时代创新本质是人类创造力。
OpenAI联手谷歌,开源 agents.md,正式统一Agent规则!
OpenAI和Google等大厂联手推出 `AGENTS.md` 标准,旨在用统一文档取代厂家特定配置文件,为AI Agent提供通用‘项目说明书’。它收录AI完成任务所需技术细节,支持嵌套,还倒逼开发者规范文档协作。
小扎又开源了:7B实现自监督学习SOTA
Meta发布全新开源视觉模型DINOv3,首次证明自监督学习模型能在广泛任务中超越弱监督学习模型。它用无标注方法,扩展数据和模型规模,支持标注稀缺场景,在多任务实现SOTA。