「Agent任务」共找到 4143 篇相关文章
大模型Agent的下一阶段:可自我进化的AI-Agent
在人工智能飞速发展下,研究者探索让AI自我反思改进。本文作者构建自我进化AI智能体系统,设计四层渐进式架构,经《卡坦岛》实验,证明自我进化能力,不同模型表现有差异,代码级进化潜力惊人。
Atlas退场:OpenAI放弃的不是浏览器
OpenAI宣布放弃浏览器Atlas,它将被内置到ChatGPT和Codex里。如今‘Agent first’成共识,浏览器是Agent能力体系组件,非入口,独立AI浏览器可能方向错误。
在 OpenClaw 的冲击下,Cursor 已经要过时了
Insight Partners 联合创始人 Jerry Murdock 接受访谈,认为自主 Agent 是 AI 浪潮核心,Cursor 已过时。还提到会有自主 Agent 专属技术栈,软件未来将由 Agent 购买,劳动力市场会受冲击,现在是创办新基金的最佳时机。
强化学习也能预训练?效果可提升20倍,华人新作引爆RL新范式!
伯克利团队提出新方法InFOM,不依赖奖励信号,能在多任务中超强迁移与推理。在36个基于状态和4个基于图像的任务测试中,InFOM表现出色,在jaco任务上改进达20倍。
一夜狂揽 6k Star,232 个 AI 专家,真疯了!
开源项目 `The Agency (agency-agents)` 增长惊人,单日获 6K+ Stars,十天新增 3.3 万+。它打包开源 232 个 AI Agent 角色、16 个部门,各 Agent 有完整“人格系统”,支持多种主流工具,不过 Token 消耗大。
最新!万字综述Harness革命!
作者分享Harness Engineering直播笔记,介绍Harness解决Agent落地卡点,其公式为Agent = Model + Harness,有六大核心组件,还梳理了主线,指出Harness是驾驭Agent不确定性的关键,且工程师不会失业。
Nature重磅研究:大模型让你变得更聪明还是更笨了?创造力增强还是扼杀了?
《自然》研究表明,大语言模型对创造力的影响取决于任务。简单任务中,它像灵感助推器,分担认知负荷;复杂任务里,易致‘创意固化’,长期依赖还可能使大脑‘变懒’。需按需调节使用。
找了一圈,部署扣子的开源版本,还得是你
7月26日,Coze将旗下“扣子开发平台”和“扣子罗盘”开源,加上此前的Eino,其开源拼图逐步补齐。Coze Studio可开发AI Agent,Coze Loop能解决Agent生命周期问题,还可借助火山引擎一键部署,降低开发门槛。
The Batch: 893 | 从预测到执行
2026 年 AI 研究应认识到能预测的模型不等同于能行动的系统。过去十年在被动预测和生成建模成就非凡,但现实任务需系统执行一系列动作。转向长周期任务和目标导向 AI 系统有两大好处。
Harness Engineering 时代的失败经验
作者分享在Harness Engineering时代使用Coding Agent的经验,指出虽Agent发展快且有成功案例,但实际应用有诸多问题,如部分模型体验差、自然语言模糊影响长程工作等,还给出解决思路,文章会持续更新。