「研究Agent」共找到 4329 篇相关文章
Agent性能暴涨90%,刷榜GAIA可太容易了~
今年AI Agent层出不穷,当前研究缺乏统一标准、复现难。oppo Agent团队分享构建高效Agent的关键组件及刷榜GAIA的方法,从事实获取能力和逻辑推理保真度两维度分析,介绍了强化感知和提升思维的策略。
Agent效率X10,ClaudeCode/Codex 专属的文件管理Agent:Agentfile
Claude Code创始人用多Claude并行开发,作者受启发做了Agentfile。它能将项目文件夹变为标签页,便于切换,从Wave改进而来,轻量且适合承接HTML结果,是Skill驱动的Agent,定位为多Agent工作流收口台。
Hermes Agent 发布更新 Herald:实时语音 + Agent 之间可以互相通信了
Hermes Agent 更新到 v0.20.0 代号 Herald,增加实时语音对话与唤醒词,可验证引用来源可信度,集成签名Webhook,支持代理到代理协议,还有性能与安全方面更新,顺应新 Agent 发展趋势。
Agent/Skills/Teams 架构演进过程及技术选型之道
文章结合作者实践与多篇论文,梳理Agent架构从单点提示词调用到Agent Teams的演进逻辑,分析Single Agent、Multi - Agent、Agent Skills、Agent Teams的优劣,给出架构选型建议,强调架构应与问题复杂度匹配。
阿里云的野心,不在 Agent Builder
近期云厂商动作整齐,如阿里云推出企业级 Agent 全栈服务平台 Agent Studio。企业做 Agent 面临基础设施难题和高成本问题,业内探索了自建、用开发框架、企业级 Agent 平台三种路径,阿里云 Agent Studio 在多方面替企业解决麻烦,还可能改变云服务模式。
18 岁创业者用 OpenClaw 管 16 个 AI Agent,一个人的 Agent 公司怎么运转
18岁无编程背景创业者用OpenClaw搭建多Agent协作平台,16个Agent分工明确,配合Claude、GLM等工具提升生产力。他分享工作流搭建、成本、模型选择等经验,还谈了对OpenClaw发展的看法。
AI两天推翻20年工作习惯!Karpathy百行代码开源项目“封神”,AI替你通宵肝研究、战绩可查
特斯拉前AI总监Andrej Karpathy开源autoresearch项目,让AI Agent自主搞深度学习研究。两天内Agent完成276次实验,提升模型训练效率约11%。项目代码极简,未来目标是实现Agent大规模协作,已被开发者社区共建。
GuardAgent:首个专门为LLM agent提供安全Guardrail 的守卫型agent
近年LLM从对话工具变为可自主执行任务的agent,但带来安全隐私挑战。传统安全监护对其力不从心,为此学者发布GuardAgent,它守卫agent,具通用性、精确判断和免训练部署优势,实验表现佳。
模型即 Agent 的含金量:Kimi深度研究功能详评
作者分享Kimi深度研究功能体验。其基于端到端自主强化学习技术,会开源模型。在测试中,分析Labubu爆火原因、检索小米发布会内容,展现出强逻辑分析、搜索准确性和数据处理能力,可视化网页也出色。
RAG 进化之路(祛魅 Agentic RAG):传统 RAG 到工具与强化学习双轮驱动的 Agentic RAG
文章旨在祛魅 Agentic RAG,先介绍传统 RAG 的离线入库和在线应用,指出其不足。再阐述 Agentic RAG 让 LLM 自主决策,结合工具执行循环。还介绍基于提示词和强化学习的实现方式,最后总结不同 RAG 的优劣。