「Agent 2.0」共找到 4718 篇相关文章
一句话生图要过时了?开源图像生成Agent进化出「工具编排」
来自多机构的研究团队提出GenEvolve,将开放图像生成建模为「工具编排轨迹」。它配置三类工具,经多轮决策完成生成。通过构建数据集训练,实验显示在多基准上表现出色,已开源模型、代码等。
构建分层的 Agentic RAG 系统:具备自主纠错的多模态推理
企业 AI 团队面临 RAG 系统在处理结构化与非结构化数据时的难题。本文探讨用分层多智能体编排解决“模态鸿沟”,介绍 Protocol - H 架构,阐述组件、机制、实现与集成,经基准测试验证其优势,还提及未来研究方向。
Agent不是关键!人大AiScientist实现23小时、74轮长程记忆
中国人民大学团队打造的AiScientist,旨在解决长程机器学习研究工程的持续性难题。它通过File - as - Bus机制稳定保存项目状态,在多轮实验中表现出色,提升科研效率,推动AI真正接手科研流程。
iPhone本地跑Gemma 4火了,0 token时代还有多远?
谷歌开源新模型Gemma 4,部分小型号可在手机端本地运行,速度惊人,还有128k上下文窗口。但在处理复杂任务时表现欠佳。未来端侧模型有望蚕食云端高频简单任务,将冲击现有AI商业模式。
当模型成为公共基础设施,特赞如何架构企业级 Agentic AI?
当大模型成公共基础设施,企业需构建围绕业务结构的智能系统架构。特赞提出的 GEA 企业级智能体架构体系,围绕企业业务运行结构设计,能让智能体参与企业经营判断。
陶哲轩:AI 已经把想法成本降到几乎为0了...
著名数学家陶哲轩在与播客主持人Dwarkesh Patel的对谈中分享使用AI一年后的观点,认为AI已将想法生成成本降至几乎为零,但验证和评估成新瓶颈,还探讨其对数学研究的影响及未来发展。
ICLR-26腾讯混元:Agent是强大的,但用户是狂野的
现有LLM工具使用基准测试场景理想化,忽视真实用户行为复杂性。腾讯提出WildToolBench,基于真实用户行为构建测试集,对58个模型评估,发现模型准确率低,揭示LLM在真实场景下能力缺口,为模型优化指明方向。
19.2K Star!Linux上无缝运行Win应用,超酷~
在Linux系统下运行Windows应用一直是难题,开源项目WinBoat能让Linux用户无缝运行Windows应用,通过容器和远程桌面技术,将Windows应用变Linux原生窗口,还具备自动化部署等多样功能。
年前看到最有深度的AI下半场Agents记忆机制综述
本文是一篇83页的基础智能体记忆机制综述,由27家机构联合发表。提出AI研究范式转变,记忆是填补理想与现实差距的关键。构建三维统一分类框架,介绍记忆操作、学习策略、评估体系、应用场景及未来方向。
不训练,解锁Agentic智能!微软:只需给LLM一台电脑
人大、MSR、清华的LLM - in - Sandbox开启「通用代理智能」新范式,把大模型放进“虚拟机”,让其在6大任务上成绩全线暴涨,零额外训练解锁“通用代理智能”,还介绍了相关实验、优化及效率情况。