「智能复盘Agent」共找到 5408 篇相关文章
听了Andrej Karpathy最新2小时访谈,我对Agent彻底祛魅了
Andrej Karpathy在播客中表示,Agent发展还需十年,离像实习生工作还差很远,要解决诸多能力问题;他认为强化学习糟糕但其他方法更糟,还提出AI应削减背书式记忆、未来强大AI或仅十亿参数等观点。
一场机器人黑客松,让具身智能的差距与机会同时显形
作者参加深圳机器人黑客松,这是全球最大规模线下具身智能开发者大赛之一。3天内参赛队伍可完成从数据采集到真机部署闭环。比赛让行业差距与机会显形,凸显基模重要性,自变量也给出新方向。
拿着做数学题的 PRM 来评判 Agent 调用工具,基本是行不通的!
目前评估体系多为结果导向,在工具调用上缺乏像样的PRM基准。Arizona State University和Intuit AI Research研究者推出ToolPRMBench,指出用做数学题的PRM评判Agent调用工具行不通,还介绍了其构建方法、训练范式和实验结果。
一键式训练端到端Agent,Qwen3+MCP工具集高效集成!
RLFactory是开源的端到端RL后训练框架,将环境与训练解耦,用Qwen3基座调用MCP工具集,可低代码训练端到端Agent模型。它极致易用、训练高效,还支持一键式训练,未来会更易用高效。
再也不用盯着几十个终端窗口!Claude Code推出Agent视图,一屏管所有
Claude Code推出Agent视图功能,能让用户在一个界面统一管理所有Claude Code会话,改善了会话可视化和交互方式。用户可总览会话、不离开视图查看回复、随时切到后台,开发者也有多种典型用法。
腾讯提出“我思故我玩”Agent:LLM构建推理与规划世界模型
腾讯与武大联合发表论文提出 CEL 新型 Agent 架构,通过 LLM 驱动两阶段循环实现“思考式学习”。它能填补传统方法短板,在小游戏实验中表现出色,有可解释性等优势,但也有实验环境局限等问题。
飞猪搭建系统演进:从人工运营到多Agent协同搭投生产
飞猪移动端页面搭建体系从初代寄生于阿里集团平台,发展成“搭投”体系。但传统人工选搭投模式待优化,为此启动AI智能搭投升级专项,构建新范式,还介绍产品结构、技术实现及后续规划。
“美国大豆包”Gemini翻身:输出速度碾压同行、智能水平重回第一梯队
过去 Gemini 被吐槽,如今 Google 推出 Gemini 3.8 Flash,六周内第三款 Flash、四个月内第四次更新。新模型成绩佳,输出快,成本低,智能体评测进步大,从经济型选项成生产主力,但实际表现待检验。
谷歌悄悄加了个按钮,Gemini长出手脚变打工人!三巨头抢着教AI干活
谷歌悄悄为Gemini添加「Agents」入口,其将从聊天助手转变为Agent运行平台。谷歌还推出无代码/低代码的Agent Designer。此外,谷歌、Anthropic、OpenAI在编排层展开竞争,焦点转向谁能让更多人用上Agent。
3.6K Star 开箱即用!开源Agentic浏览器,Perplexity Comet最强平替!
传统浏览器缺乏AI自动化能力,新兴的Perplexity Comet又有云端依赖和费用高的问题。开源的Agentic浏览器BrowserOS可作其平替,有AI聊天扩展等组件,功能强大且跨平台,能带来安全智能的浏览体验。