长时程任务」共找到 2435 篇相关文章

产品应用8

拖拽式搭建分布式Agent工作流!Maze让非技术人员几分钟搞定复杂任务

大模型智能体落地有诸多问题,Maze分布式智能体工作流框架可提供一站式解决方案。它是集成分布式执行引擎的全能平台,有四大核心优势,还有可视化工具让非技术人员也能轻松搭建工作流。

量子位
开源动态7

任务狂飙16小时!模型+Harness双轮驱动,金融Agent跑通了

2026年AI圈热词Harness成Agent产品基础设施。通用Harness难适配金融订单,易鑫首席科技官贾志峰将开源自研Harness Framework,采用三层驾驭体系,实测效果佳,成本低。

新智元
算法论文8

WWW'26 | 跨任务自适应的Multi-Agent协作新范式

大型语言模型驱动的多智能体系统成解决复杂任务重要范式,但智能体协作存在关键问题。Griffith和西北农林科技大学团队提出OFA - MAS,将多智能体拓扑设计从one - for - one推向one - for - all,实验效果佳。

PaperAgent
产品应用8

跨机器、物体与各种任务!RoboScience发布通用具身大模型

RoboScience机器科学发布Visics通用具身大模型并披露VLOA技术架构。该模型从底层搭建全新具身基础表征单元,适配任意机器人、物体和任务。其由具身世界模型和通用操作模型组成,有强大泛化和操作能力。

AIGC开放社区
算法论文8

静态稀疏已死:Flux Attention 开启文本 LLM 自适应推理新时代

文章指出上下文LLM高效推理面临性能与效率难题,先介绍Elastic Attention打破静态稀疏桎梏,后重点阐述全新的Flux Attention,它将动态稀疏注意力范式升级为层级别路由,解决了算法与硬件的矛盾,在多方面实现突破。

深度学习自然语言处理
算法论文8

DeepAgent:能够自主找工具的深度思考智能体,工具&任务随心配

现有智能体框架自主性差、工具使用受限。中国人民大学等机构研究者提出DeepAgent,能自主思考、发现工具并执行动作。它在多基准测试中表现出色,为构建更强真实世界智能体迈进重要一步。

PaperAgent
推荐文章7

现在模型这么强还需要专业提示词吗?

文章探讨是否还需专业提示词,指出简单任务无需复杂提示词,但复杂任务时,它能像‘数学公式’拆解需求,还能充当‘工作流经理’。用好提示词能让AI成生产力工具。

宝玉AI
算法论文8

Auto Research时代,47个没有标准答案的任务成了Agent能力必测榜

Einsia AI旗下Navers lab发布Agent Benchmark——Frontier-Eng Bench,让AI在47个多学科交叉的硬核任务中做工程优化,测试其迭代优化能力。研究总结出AI进化规律,初步勾勒接近真实工程循环的AI系统。

量子位
算法论文8

低Token高精度!字节复旦推出自适应推理框架CAR

字节与复旦大学研究人员提出自适应推理框架CAR,能根据模型困惑度动态选短答或推,在多基准测试中平衡了准确性与效率,打破文本推理必然性能更好的认知。

量子位
开源动态8

开启端侧文本时代!面壁全新架构,让小钢炮最快提升220倍

2025智源大会上,面壁智能发布MiniCPM 4.0模型,实现行业首个系统级上下文稀疏语言模型创新。它在端侧推理任务上表现出色,降低缓存需求,提高运行效能,还进行多维度架构创新,是AI领域探索高效率语言模型的里程碑。

机器之心