「Agent RL」共找到 2851 篇相关文章
听了Andrej Karpathy最新2小时访谈,我对Agent彻底祛魅了
Andrej Karpathy在播客中表示,Agent发展还需十年,离像实习生工作还差很远,要解决诸多能力问题;他认为强化学习糟糕但其他方法更糟,还提出AI应削减背书式记忆、未来强大AI或仅十亿参数等观点。
推理能力再突破!蚂蚁 | 提出Agentic Deep Research新范式,可信度同步增加
尽管LLM能力提升,但复杂任务表现受静态知识限制。业界提出Agentic Deep Research系统,现存系统训练有梯度冲突和奖励稀疏问题。蚂蚁团队提出Atom - Searcher,创新推理范式,构建细粒度奖励,结合奖励训练,实验效果佳。
OpenAI深夜发布ChatGPT Agent:能主动思考、自选工具,智能体赛道大变天
今天凌晨1点,OpenAI发布ChatGPT Agent,它能自主思考行动,自选工具完成复杂任务。首席执行官Sam Altman发文介绍,虽实用但有风险,内置安全机制。测试中表现优异,网友期待体验。
再也不用盯着几十个终端窗口!Claude Code推出Agent视图,一屏管所有
Claude Code推出Agent视图功能,能让用户在一个界面统一管理所有Claude Code会话,改善了会话可视化和交互方式。用户可总览会话、不离开视图查看回复、随时切到后台,开发者也有多种典型用法。
谷歌悄悄加了个按钮,Gemini长出手脚变打工人!三巨头抢着教AI干活
谷歌悄悄为Gemini添加「Agents」入口,其将从聊天助手转变为Agent运行平台。谷歌还推出无代码/低代码的Agent Designer。此外,谷歌、Anthropic、OpenAI在编排层展开竞争,焦点转向谁能让更多人用上Agent。
新晋顶流Agent颠覆设计师!Lovart一手实测来了:是该刷屏爆火
新晋顶流Agent Lovart火爆全网,可一句话搞定专业视觉设计,支持二次编辑。量子位实测其设计能力强,背后是多模型融合调度。它定位人机协作,适合中小企业,官网可申请内测。
颠覆搜索引擎,下一代Agentic Deep Research!12家顶尖学术机构联手提出
在信息获取方式变革背景下,12家顶尖机构联合发布论文提出Agentic Deep Research,它由大模型驱动,可自动规划检索路径等,或颠覆传统搜索范式,且有基准成绩和TTS Law支撑,开源生态也在聚焦。
专访丨华人大三学生创业教育 Agent,获赵长鹏 1100 万美元种子轮
硅谷华人大三学生创立的教育类 AI 产品 VideoTutor 完成 1100 万美元种子轮融资,由赵长鹏家办 VC 领投。这是面向 K12 学生的 AI 教育 Agent,能一键生成专属教学视频。文中还探讨了其功能、优势及团队发展规划。
从繁杂技巧到极简方案:ROLL团队带来RL4LLM新实践
当前RL4LLM领域发展快但存在标准、结论不一及机制解释不足等问题。阿里巴巴淘天集团和爱橙科技联合高校基于ROLL框架研究,评估关键技术组件,提出简化算法Lite PPO,在多基准上表现佳。
Agentic Deep Research新范式,推理能力再突破,可信度增加,蚂蚁安全团队出品
尽管LLM能力提升,但在复杂任务上受静态内部知识限制。业界提出Agentic Deep Research系统,不过现存系统有梯度冲突和奖励稀疏问题。蚂蚁安全团队提出Atom - Searcher,解决上述问题,实验效果良好。