Agent 3」共找到 4404 篇相关文章

推荐文章7

从 GPT 到 Agent,技术与业务如何“双向奔赴”

InfoQ《极客有约》X AICon 直播栏目邀请徐文健、李陈忠、张昊阳探讨大模型产品落地路径。他们分享从 GPT 到 Agent 的经历、认知转变,讨论通用 Agent 及创业机会,还谈及 AI 产品难点和人才标准变化。

InfoQ
推荐文章8

为什么 Agent Memory需要 AML:看 AML “变量控制”的工程设计

传统 Agent 记忆评测有水分,近日放榜的 Agent Memory Leaderboard (AML) 通过严格控制变量构建盲测管线。文章从技术架构深拆其工程细节,还分析了首期榜单,指出其重构评估变量的价值。

AI工程化
新闻资讯8

微软发布AI Agent故障白皮书,万字解读各种恶意智能体

微软发布《AI Agent系统故障模式分类》白皮书,解读Agent故障。故障分新型和既有两类,如智能体伪装、智能体内在安全问题等,还给出身份管理、内存强化等安全设计建议。

AIGC开放社区
算法论文8

Agent RL 总是训练崩?UCLA 这篇论文给了救命稻草!

这篇解读UCLA和威斯康星大学麦迪逊分校论文《ARLArena: A Unified Framework for Stable Agentic Reinforcement Learning》的文章指出,Agent RL训练易崩溃,原因在于多轮交互任务带来奖励稀疏等问题。论文建“竞技场”,提出SAMPO算法提升稳定性,还给出从业者建议。

深度学习自然语言处理
开源动态8

英伟达MoE新开源:一行import,微调加速3.7倍

英伟达开源NeMo AutoModel,基于Hugging Face Transformers v5,不改代码API,添一行import就能更快速微调MoE模型。实验显示,它能提升3.4 - 3.7倍训练吞吐,减少29% - 32% GPU显存占用。

量子位
新闻资讯7

Anthropic发布多Agent协作模式指南:5种架构与适用场景

当单个AI Agent无法完成任务时,多Agent系统就派上了用场。Anthropic最新发布的指南给出了五种经过验证的模式,包括生成 - 验证模式、编排 - 子代理模式等,并介绍了适用场景和陷阱。

AI工程化
产品应用7

黄仁勋预言的100万亿市场,被易鑫金融Agent撞开一道口子

大模型在金融行业落地潜力大但门槛高。易鑫依托行业经验,推出Agentic AI解决方案,由XinMM - AM1大模型和Harness体系组合,覆盖汽车金融全链路,已在风控等场景应用,拉开效率革命序幕。

新智元
算法论文8

ICML 2026 | Agentic强化学习训练的信息自锁问题

随着大语言模型走向真实交互,强化学习训练LLM agents时出现信息自锁问题。香港中文大学等研究者分析其原因并提出AREW方法,在多场景实验中表现稳定且具鲁棒性。

机器之心
新闻资讯8

Google重磅上线通用世界模型Genie 3 - 此即未来。

Google发布世界模型Genie 3,它与Sora等AI视频产品本质不同,像可实时演算的模拟器。Genie 3解决了前辈无法调和的矛盾,在交互、时长、控制等方面有突破,虽有局限,但打开新世界大门。

数字生命卡兹克
8

挺意外的,Agent长期记忆潜力被AMemGym挖出来了

论文提出交互式在线策略评测框架AMemGym,它能反映AI助手长期记忆能力、驱动Agent自我进化记忆。它以结构化状态演化为骨架支撑自由对话评测,还对主流记忆系统做了扫描,带来评估与训练范式转换。

PaperAgent