智能体任务」共找到 4876 篇相关文章

算法论文8

ICLR 2026 | LongHorizonUI:让 GUI 智能不再"半途而废"——面向长链路任务的统一鲁棒自动化框架

近年来,基于多模态大语言模型的GUI智能在自动化操作上虽有进展,但任务步数超10 - 15步时成功率断崖下跌。研究人员提出LongHorizonUI框架,构建LongGUIBench评测基准,推动GUI自动化在复杂场景落地。

机器之心
算法论文8

大模型如何泛化出多智能推理能力?清华提出策略游戏自博弈方案MARSHAL

近日,清华大学等机构研究团队提出 MARSHAL 框架,利用强化学习让大模型在策略游戏自博弈。实验表明,多轮、多智能训练提升了模型博弈决策水平,将推理能力泛化到通用多智能系统,在一般推理任务表现显著提升。

机器之心
算法论文8

破解「长程智能」RL训练难题,腾讯提出RLVMR框架,让7B模型「思考」比肩GPT-4o

腾讯混元AI数字人团队提出RLVMR框架,将‘元认知’理论引入RL,通过奖励‘好的思考过程’解决长程任务智能的低效探索与泛化难题,经其训练的7B模型表现出色。

机器之心
产品应用7

The Batch: 922 | 面向智能的管理系统

OpenAI 发布 Frontier 平台,用于编排和管理企业级 AI 智能团队。它支持智能构建、信息共享等,Cisco 等已试点,未来将更广泛开放。与 Microsoft 的 Agent 365 有不同侧重,企业对智能集中管理需求渐显。

DeeplearningAI
新闻资讯8

全国首部AI智能应用评估标准,现公开征集起草单位和个人!

2025年成AI智能元年,国务院提出到2030年智能等应用普及率超90%目标。但企业部署智能面临‘效能黑箱’。智合标准中心发起《企业级AI智能应用效能评估规范》团标准起草,现征集起草单位和个人。

PaperAgent
开源动态8

最新智能自动操作手机电脑,10个榜单开源SOTA全拿下|通义实验室

通义实验室推出Mobile - Agent - v3智能框架,在多核心榜单获开源最佳。它能完成复杂任务,在多智能框架中灵活切换角色。团队搭建云环境基建,从多维度构建数据,用强化学习和多智能协作提升其性能。

量子位
推荐文章7

评论送书 | Al智能与传统AI应用的区别?它如何工作?如何快速构建智能

文章对比AI智能与传统AI应用,指出前者更像“乐高积木”,可融入生活工作。介绍其工作是“感知—推理—执行—学习”循环,还给出快速构建通用方法,如明确目标、选框架等。

AIGC开放社区
开源动态8

Agent群智能来了!魔搭开源Agent自进化群智能框架:群记忆自动蒸馏与进化,8万+群技能即取即用,智能画像一键复用

个人或团队部署使用智能面临状态易失、重复试错、迁移困难等痛点。魔搭ModelScope团队开源的Ultron框架,补上群协作基础设施,解决经验沉淀、技能进化和画像共享问题,提升智能协作效率。

量子位
开源动态8

首个自主数据科学的智能

DeepAnalyze是业界首个能自主完成数据科学任务智能大语言模型,可自动执行数据准备、分析等任务,支持多种数据源,且模型、代码等全部开源,还给出了使用和开发方法。

GitHubStore
产品应用7

评论送书 | 我用扣子(Coze),五分钟搭建出一个客服自动应答智能

文章以设计‘产品功能咨询智能’为例,介绍用扣子平台搭建客服自动应答智能的全过程,包括创建项目、工作流、搭建流程框架及试运行优化,还推荐了相关书籍。

AIGC开放社区