「LLM Agent」共找到 3432 篇相关文章
刚刚,Claude Code大升级!卡帕西:LLM第三次变革
Anthropic发布企业协作工具Claude Tag,定位为Claude Code进化版,更擅团队协作。约65%产品代码由其参与完成,卡帕西称是LLM用户界面第三次变革。它能深入企业工作流,已在Slack测试。
Claude推出Agent View:一次管理所有编码会话
Anthropic为Claude Code新增Agent View功能,可集中管理编码会话,已开放研究预览。开发者操作路径清晰,早期用户总结出实用玩法,解决了常开多任务的切换难题,目前部分计划可体验。
游戏教父 John Carmack:LLM 不是游戏的未来
游戏教父 John Carmack 认为 LLM 不是游戏未来,强调交互式体验学习重要性。他分析游戏学习现状,指出 Atari 游戏研究虽有成果但仍存问题,还探讨强化学习多方面挑战及应对思路。
Parlant:一个让AI Agent 真正听话的开源框架
AI Agent存在不听话的痛点,Parlant开源框架专门解决此问题。它与传统方法不同,能确保执行规则。具备行为准则、对话流程等功能模块,适用于金融、医疗等场景,已在金融场景落地。
AI Agent已过时?OpenAI亮出王牌Deep Research!
浙江大学一篇综述论文《A Comprehensive Survey of Deep Research》系统性梳理了Deep Research赛道。它是一类AI系统,其背后的Agent范式可迁移到各场景,文章介绍了其技术、架构、应用及面临的挑战与未来方向。
AI下半场的战场,从Agent记忆体正式打响
OpenClaw开源项目爆火,标志AI进入下半场走向真实应用。关键在于解决AI在现实中持续干活的问题,核心是Agent Memory。论文梳理该赛道,指出其是系统级记忆体结构框架,未来关键在memory策略可学习。
实测Kimi全新Agent模型「OK Computer」,很OK
Kimi发布全新Agent模型「OK Computer」,依托Kimi K2,能搭网站、做PPT、处理大量数据。实测显示它在设计、生成、分析类任务表现不错,设计无需找素材,分析无需想角度,生成还能推荐风格。
一篇19种自进化Agent Skill框架最新综述
这篇来自Rutgers大学和UNC Charlotte的survey,首次系统梳理Agent技能的进化与评估全貌,覆盖19种技能进化方法和10个评估基准。指出当前评估体系有诸多不足,如无法追踪技能多轮反馈后是否变好等。
谷歌AI Overview上线!Reddit遭殃,Agent笑了~
Google搜索兑现I/O上提到的AI搜索能力,上线AI mode、AI overview,目前部分结果中有广告。Reddit成谷歌AI首个受害者,其依赖谷歌流量且签有数据授权协议。而overview对利用browser use的Agent是利好。
为什么Agent总是Demo猛如龙实战一条虫?
一篇51页论文研究主要智能体,指出适应性是关键。它提出2×2分类框架将适应方法分四大范式,还明确不同范式优缺点,发现T2范式数据效率远超A2。最后点明Agent适应性研究的四个前沿方向。