多Agent」共找到 5996 篇相关文章

产品应用7

Cursor 2.0 来了!自研模型 Composer1,更禅的界面,代理并行,Browser调试更强大

Cursor 2.0 发布,有诸升级。它有自研编码模型 Composer1,速度快且适合 Agent 模式;界面更清爽禅意;支持代理并行,能提升编码效率;浏览器可嵌入编辑器,沙盒终端在 macOS 正式发布等。

AI进修生
算法论文8

像开发软件一样造世界,Agent2World来了,把世界模型做成可运行的符号环境

为让模型真正“能行动”,需可执行、可验证的符号世界模型,但现有自动生成路线有困局。研究团队提出 Agent2World,经实验验证有显著效果,能稳定产出高质量符号世界模型,开辟 AI 理解现实环境新可能。

机器之心
新闻资讯8

“养虾”热潮下,专家帮你拆解Agent如何重写软件逻辑 | 奇点智能技术大会首日精彩回顾

2026 奇点智能技术大会聚焦 AI 发展新趋势,探讨 Agent 对软件与互联网产业的重构。会上发布白皮书、评测榜单,成立开发者社区,位专家分享见解,涉及 AI 研发、模型协同、大模型演进及科学模态模型等内容。

AI科技大本营
新闻资讯8

“商业的HTTP”来了:谷歌CEO劈柴官宣 UCP,Agent 直接“剁手”下单,将倒逼淘宝京东“拆家式重构”?

谷歌CEO近日宣布开放标准UCP,目标是让Agent在线购物,将购物流程拆解成可复用组件。风险投资人认为其想成商业领域的“HTTP”,不少行业人士看好。它还能与其他协议协同,发布首日吸引众伙伴。

InfoQ
开源动态7

小红书发布 SWE-Bench Mobile:当 AI Agent 面对亿级用户 App 代码库,最高通过率仅12%?

小红书联合科研机构发布 SWE-Bench Mobile,它是首个还原‘端到端’开发流程的基准,以小红书 App 实际任务为核心。评测显示,AI Agent 在移动端开发能力上限低,架构设计比模型本身重要,简单提示策略效果更好。

InfoQ
算法论文8

Coding Agent 自主解题很强,但用户改一行代码就"翻车"?自所团队提出 SWE-Touch 揭示共享工作空间下的能力缺口

当前基于大模型的Coding Agent是热门研究方向,现有评测假设其独占代码仓库。中科院自动化所团队构建SWE - Touch框架,对9个前沿模型测试,发现用户干预下模型性能下降、排名洗牌。

深度学习自然语言处理
产品应用8

AI短漫剧的Netflix来了!恒星AI推出全球首个影视级AI Agent「Starfilm」,打造AI短漫剧制作的“超级梦工厂”

恒星AI推出全球首个影视级AI Agent「Starfilm」,能一站式完成AI短漫剧创作。它集剧本、数字人、音乐等核心能力,还搞“星光计划”助力创作者在平台分发变现,让“一人成剧”梦想成真。

AI寒武纪
产品应用8

谷歌 agent-skills 根治 6 大 AI 编码通病

Chrome团队的Addy Osmani将Google的senior流程写入agent - skills,用24个Markdown文件针对AI编码时Agent常犯的6大错误,写死补救流程,提升Agent编码质量。

CourseAI
算法论文8

GPT-5-Codex背后AI Agentic编程技术最新全面综述!

近期OpenAI发布GPT - 5 - Codex,其背后AI Agentic Programming重塑软件开发流水线。介绍了AI Agentic编程定义、典型工作流、技术底座、主流Agent对比分类,还展望未来5大机会。

PaperAgent
产品应用7

最强协作模型?MiniMax M2.7 实测:AI开始更会合作了 | Claude Teams

MiniMax M2.7模型发布,强调模型自我进化、Agent Harness和Agent Teams。它能构建复杂Agent Harness,完成高难度生产力任务。其能力达国际一线水平,在测试中成绩优异。还介绍了Harness、Agent Teams等概念及应用场景。

AI进修生