智能体训练」共找到 5155 篇相关文章

产品应用8

美团提出首个语音交互GUI智能,端到端语音训练能力优于传统文本训练

美团和浙大联合推出GUIRoboTron - Speech,这是首个能利用语音指令和屏幕截图端到端决策的自主GUI智能。它解决了文本依赖问题,团队经多步骤研发,其性能评估表现佳,还给出招聘信息。

量子位
算法论文8

Scaling Law再现Agent领域!阿里提出训练新范式:在预训练和后训练之间还需一个Agentic CPT

近年来,大型语言模型向智能系统进化。但当前主流方法构建智能不佳,阿里通义实验室团队论文提出智能持续预训练(Agentic CPT)新范式,开发AgentFounder模型,在多基准测试表现卓越。

深度学习自然语言处理
算法论文8

DeepAgent:能够自主找工具的深度思考智能,工具&任务随心配

现有智能框架自主性差、工具使用受限。中国人民大学等机构研究者提出DeepAgent,能自主思考、发现工具并执行动作。它在多基准测试中表现出色,为构建更强真实世界智能迈进重要一步。

PaperAgent
新闻资讯7

GenEnv:智能与环境模拟器之间的难度对齐协同进化 | 直播预约

训练高性能 LLM 智能受限于真实世界交互数据的成本和特性,为此推出 GenEnv 框架,它建立难度对齐协同进化博弈,能让智能表现提升,减少数据使用量,为扩展能力提供数据高效路径。

深度学习自然语言处理
算法论文8

端到端GUI智能首次实现“犯错-反思-修正”闭环,模拟人类认知全过程

南洋理工大学MMLab团队提出框架GUI - Reflection,让端到端多模态GUI智能有“自我反思”能力。它在各训练阶段引入“反思与纠错”机制,实验证明该框架能提升智能能力。

量子位
产品应用8

腾讯的这款AI数据智能工具Lumos,颠覆了传统的数据分析

文章聚焦腾讯AI数据智能工具Lumos,它是Tomoro的数据智能,采用多智能架构解决复杂问题。文中介绍其技术思路、实践方案,如解决多智能一致性、提升查询响应等,还提及后续优化方向。

腾讯技术工程
算法论文8

只需1/4预算,性能反超基线:阿里高德提出Tree-GRPO,高效破解智能RL难题

阿里高德提出Tree - GRPO方法解决智能RL难题。它以智能步骤为节点树搜索,在11个数据集中更省预算、表现更好,能在1/4预算超GRPO基线,解决了Rollout成本高和监督稀疏问题。

机器之心
算法论文8

智能「卷王」诞生!干活自动配结项报告,1.5张截图就把事说清了

在LLM/VLM驱动的智能强化学习研究中,验证完成度是挑战。为此提出SmartSnap方法,让智能成“质检员”,主动留痕存证。它有三大突破,表现惊艳,简化训练准备,让AI更可靠。

量子位
推荐文章7

A2A:多智能的协作总线

文章介绍了A2A协议,它是多智能系统的“协作总线”,能让不同智能安全高效协作。阐述其核心使命、与MCP区别、核心概念、工作流实例,还描绘了“智能社会”愿景,并给出基于官方文档的实现示例。

AIGC开放社区
产品应用7

The Batch: 922 | 面向智能的管理系统

OpenAI 发布 Frontier 平台,用于编排和管理企业级 AI 智能团队。它支持智能构建、信息共享等,Cisco 等已试点,未来将更广泛开放。与 Microsoft 的 Agent 365 有不同侧重,企业对智能集中管理需求渐显。

DeeplearningAI