研究型智能体」共找到 5007 篇相关文章

算法论文8

303页年度最佳AI Code综述:阿里、字节、快手30家顶级机构出品

分享303页《从代码基础模智能体与应用:代码智能实践指南》,由近30家顶尖机构出品。介绍2021 - 2025年代码大语言模发展,分析通用与代码专用LLM能力,阐明研究 - 实践差距,还开展实验。

PaperAgent
算法论文8

ICLR 2026 | LongHorizonUI:让 GUI 智能体不再"半途而废"——面向长链路任务的统一鲁棒自动化框架

近年来,基于多模态大语言模的GUI智能体在自动化操作上虽有进展,但任务步数超10 - 15步时成功率断崖下跌。研究人员提出LongHorizonUI框架,构建LongGUIBench评测基准,推动GUI自动化在复杂场景落地。

机器之心
算法论文8

NUS、牛津等联合发布音视频智能综述:系统梳理大模时代的AVI全景图

NUS领衔近10家机构发布音视频智能综述,系统梳理大模时代AVI发展全貌,涵盖感知、生成与交互,复盘子方向工作,构建任务蓝图,整理评测体系,总结基础技术,还探讨应用、安全及未来研究方向。

新智元
算法论文8

网络基础设施如何支撑大模应用?北京大学刘古月课题组5大方向研究,相关论文入选ACM SIGCOMM 2025

智能计算和网络演进背景下,北大刘古月课题组聚焦网络研究。其 5 篇论文入选 ACM SIGCOMM 2025,从架构、数据、运维、安全四个维度形成技术闭环,推动新一代网络系统发展。

AI前线
算法论文7

开源中小模+Skills也性能暴增!卢森堡大学探索了小模驾驭Skills的边界

卢森堡大学等研究探索小模驾驭Skills的边界。工业界因数据安全渴望开源小模智能体Skills框架让小模性能暴增。研究拆解小模处理复杂任务的方法,还验证不同策略有效性,发现代码专用模优势。

AIGC开放社区
算法论文8

清华校友出手,8B硬刚GPT-4o!单一模无限工具调用,终结多智能

MIT等机构推出TIM和TIMRUN组合拳,突破模token天花板。TIM将推理建模为任务树,TIMRUN优化内存管理。二者结合支持长程推理,实现单模高效推理,简化智能体构建,在多方面表现出色。

新智元
算法论文7

ICML 2026|如何对Multi-Agent系统进行过程评估?重新认识多智能体系统中的Orchestrator

来自南京大学NLP实验室的ICML 2026论文指出,当前主流多智能体架构中,系统失败常源于负责全局调度的Orchestrator失去对任务的掌控。论文提出相关框架和方法对其进行分析与评估。

机器之心
算法论文7

《TAML》好文推荐 | 来自中国科学院力学研究所张磊博士 评估大语言模在计算流体力学领域的知识利用、学习与创造

研究聚焦评估推理(DeepSeek R1和OpenAI o3 - mini - high)与非推理(DeepSeek V3和ChatGPT 4o)大语言模在计算流体力学领域知识利用、学习与创造能力。通过三类基准问题评估,结果有差异。

力学与人工智能
推荐文章7

具身智能需要从ImageNet做起吗?

文章探讨具身智能发展,分析其爆发原因,如人类无法完全数字化等。指出几种失败模式,还讨论输入信号、触觉、学习方法等决策点,认为具身智能的‘ImageNet’时刻是伪命题,不同智能领域可能殊途同归。

海边的拾遗者
新闻资讯8

从OpenAI回国的90后姚班博导,打造了国内首个开源Agent训练框架:从OpenAI团队解散与重组,看智能体十年沉淀

本文讲述90后姚班博导吴翼的经历。他曾在OpenAI参与多智能研究,回国后投身学术与创业,打造国内首个开源Agent训练框架AReaL。他分享在OpenAI的经验,探讨创业、技术发展等问题。

InfoQ