「自驱动 Agent」共找到 3989 篇相关文章
Auto Research时代,47个没有标准答案的任务成了Agent能力必测榜
Einsia AI旗下Navers lab发布Agent Benchmark——Frontier-Eng Bench,让AI在47个多学科交叉的硬核任务中做工程优化,测试其迭代优化能力。研究总结出AI进化规律,初步勾勒接近真实工程循环的AI系统。
顶会SOSP'25最佳论文,被一个国产自研操作系统拿下
国产自研开源操作系统星绽的学术论文获顶会SOSP'25最佳论文。它专注高可扩展内存管理研究,兼顾性能与安全。星绽由多单位联合研发,用Rust语言,解决传统系统难题,已有多篇论文被国际顶级学术会议录用。
Multi-Agent记忆系统MIRIX:比RAG性能飙升35%,存储减少99.9%
现有AI Agent记忆方案有局限,MIRIX作为模块化多智能体记忆系统应运而生。它由六种记忆类型和多智能体框架组成,支持多种检索功能。在多模态和单模态测试中表现优异,为记忆增强型LLM智能体设新标准。
一个月狂揽2w+star,带你手搓自己的claude code!
Claude Code受广泛关注,但多数讨论抽象或为‘黑盒用法’。`learn-claude-code`项目对其深度拆解,通过12个课程教构建智能体载具系统,开源超一月揽34K star,还提供Web交互平台。
DeepSeek押注的Harness,被这篇最新综述彻底讲透了
这篇综述讲透了Agent Harness Engineering,CMU等联合提出ETCLOVG七层架构,证明Harness Engineering是LLM Agent工业落地主战场,介绍了其发展阶段、各层架构及作用等。
吴恩达:AI编程加速开发也埋下大坑,软件测试空前重要
吴恩达认为AI编程虽加速开发,但Agentic编码系统不可靠,会引入漏洞、删除代码等。他给出核心解法,利用Agentic测试,优先测后端和底层架构,还明确测试优先级,前端低、后端高。
人人可用、真能落地,阿里用Agent掀翻了数据分析的牌桌
文章介绍阿里全资子公司瓴羊升级“智能小 Q”,这是阿里在数据分析赛道的首份 Agent 答卷。分析了数据分析从可视化、可决策到可行动的三阶跃迁,阐述智能小 Q 在准确性、企业级能力、价值增量方面的表现及应用案例。
扣子开源全家桶,Apache 2.0加持,AI Agent又一次卷到起飞
7月26日,新一代AI Agent开发平台扣子(Coze)宣布开源零代码开发平台(Coze Studio)和调试工具扣子罗盘(Coze Loop)。二者结合已开源的Eino框架,为开发者提供全栈可用、可复用的开发工具,还采用宽松的Apache 2.0协议。
Cursor自研模型反超Opus 4.6!价格脚踝斩,氛围编程沸腾了
Cursor新编程模型Composer 2性能超Claude Opus 4.6,价格“脚踝斩”。它靠引入新强化学习方法,让模型学会“做笔记”突破上下文瓶颈,在任务中表现出色,研究员还放出Composer 3消息。
AutoDev 架构升级:多端编程 Agent(CLI/Desktop/Mobile),欢迎一起参与演进
作者介绍 AutoDev 架构升级情况,新架构基于 KMP + Compose 重构,构建多端编程 Agent,含 CLI、Desktop、Mobile 等版本。还引入 CodeGraph 节省成本,用 Compose 重塑界面,欢迎各方参与演进。