多Agent编排」共找到 6045 篇相关文章

开源动态8

AI4S又一瓶颈被攻克:两个AI「吵架」,让科研代码部署成功率突破95%

科学软件大难直接运行,制约AI4S与Agentic Science发展。Deploy - Master应运而生,是一站式自动化工作流。Search Agent筛选工具,Build Agent用双模型辩论机制使部署成功率超95%,为科学智能体交互打基础。

量子位
新闻资讯8

Karpathy:写了20年代码,现在像作弊

Karpathy曾造词“vibe coding”,一年后弃用。他开源autoresearch项目,让AI Agent自主跑实验,自己不写代码。他还展示家庭监控分析系统也由Agent完成。他提出“agentic engineering”,认为工具虽变,但深度技术专长更重要。

新智元
新闻资讯8

现场围观腾讯广告算法大赛,我都想入职了

腾讯广告算法大赛冠军可得200万奖金,赛题是「全模态生成式推荐」,涉及AI方法,贴近真实业务且挑战。比赛持续四月,氛围友好。腾讯借此揽才,也为学生提供进大厂通道。

量子位
新闻资讯8

哇塞,今天北京被机器人人人人人塞满了!

世界机器人大会在北京开幕,100个新机器人亮相。智平方的爱宝机器人人气爆棚,它能用一个基座模型完成任务。其搭载的GOVLA大模型有四大核心能力,且已在行业商业化落地。

量子位
开源动态8

全能高手&科学明星,上海AI实验室开源发布『书生』科学模态大模型Intern-S1 | WAIC 2025

7月26日,上海AI实验室在WAIC 2025上发布并开源科学模态大模型Intern-S1。它融合学科知识,首创跨模态科学解析引擎,在学科任务上超越顶尖闭源模型,还支撑构建了智能体系统。

机器之心
产品应用8

天工Skywork开始"看"小红书了,1247个帖子的图片信息被它吃透!

昆仑万维技术发布周推出Skywork Deep Research Agent v2。它整合模态检索理解和跨模态生成能力,有信息检索、小红书Agent等功能,Office Agent也有升级,还新增积分预估等特性,邀测后将全量开放。

AI产品黄叔
推荐文章8

造过 Codex 的人,为什么每天用 Claude Code

Calvin曾带队构建编程Agent Codex,如今日常用Claude Code。他和Garry Tan在播客聊了编程Agent的产品哲学差异、分发逻辑等。Claude Code拆分上下文表现出色,LLM成开发者工具推荐引擎,还探讨了构建、使用编程Agent的要点。

宝玉AI
开源动态7

DeepSeek Harness规模化踩坑实录:耗时、成本、失败到底该怎么查

Agent 进入日常研发流程后,使用方关注耗时、Token 消耗和失败回溯。DeepSeek Harness(DSH)是开源 Agent 框架,腾讯云 Agent 可观测提供 DSH 采集插件,构成全景可观测方案,还介绍接入实践与其他能力。

腾讯技术工程
开源动态8

模型一个没换,正确率翻了近三倍,这个项目有点东西啊!

GitHub开源项目AutoResearch用同一模型答题,其EvoMap蜂群模式使正确率近三倍于单Agent和常见Sub - Agent模式。它是Agent评审系统,靠蜂群机制让AI自动科研,还有诸防幻觉等特点,能用于场景优化。

开源先锋
新闻资讯8

Claude 通过率不到 4%,SaaS-Bench 撕碎了 Computer-Use 的「全自动办公」幻想

UniPat AI用SaaS - Bench测试,让Agent在真实工作环境中执行任务。结果显示,Claude Opus 4.7端到端完全通过分数仅3.8%,数模型表现差,还暴露Agent四种致命缺陷,揭示其与真实工作能力有巨大鸿沟。

机器之心