任务成本」共找到 3254 篇相关文章

算法论文8

WWW'26 | 跨任务自适应的Multi-Agent协作新范式

大型语言模型驱动的多智能体系统成解决复杂任务重要范式,但智能体协作存在关键问题。Griffith和西北农林科技大学团队提出OFA - MAS,将多智能体拓扑设计从one - for - one推向one - for - all,实验效果佳。

PaperAgent
产品应用8

跨机器、物体与各种任务!RoboScience发布通用具身大模型

RoboScience机器科学发布Visics通用具身大模型并披露VLOA技术架构。该模型从底层搭建全新具身基础表征单元,适配任意机器人、物体和任务。其由具身世界模型和通用操作模型组成,有强大泛化和操作能力。

AIGC开放社区
算法论文8

DeepAgent:能够自主找工具的深度思考智能体,工具&任务随心配

现有智能体框架自主性差、工具使用受限。中国人民大学等机构研究者提出DeepAgent,能自主思考、发现工具并执行动作。它在多基准测试中表现出色,为构建更强真实世界智能体迈进重要一步。

PaperAgent
开源动态8

统一VLA范式!港科大开源StarVLA乐高式架构,复现成本大幅降低

当前具身智能的VLA赛道陷入「碎片化」泥潭,方法难对比、复现成本高。港科大开源StarVLA,提出「乐高式」统一架构,构建模块化开源底座,实现双向模块化,还支持多种训练范式,打通Sim2Real。

新智元
推荐文章7

现在模型这么强还需要专业提示词吗?

文章探讨是否还需专业提示词,指出简单任务无需复杂提示词,但复杂任务时,它能像‘数学公式’拆解需求,还能充当‘工作流经理’。用好提示词能让AI成生产力工具。

宝玉AI
算法论文8

警惕!大模型成本倒挂:你正在为模型的多余「思考」买单

一项来自多所高校和微软研究院的研究揭示AI模型价格倒挂现象,低定价模型可能产生更高实际开销。研究聚焦8个前沿推理模型和9个主流数据集,指出推理token是成本倒挂主因,且实际开销难以预测。

机器之心
算法论文8

Auto Research时代,47个没有标准答案的任务成了Agent能力必测榜

Einsia AI旗下Navers lab发布Agent Benchmark——Frontier-Eng Bench,让AI在47个多学科交叉的硬核任务中做工程优化,测试其迭代优化能力。研究总结出AI进化规律,初步勾勒接近真实工程循环的AI系统。

量子位
新闻资讯7

AI也能换岗了!Anthropic教智能体交接班,不怕长任务断片

Anthropic设计出长时智能体运行框架,让AI跨越数小时任务渐进式推进。其采用双智能体架构,结合环境管理方法,提升全栈Web应用开发稳定性,但仍有通用与多智能体架构选择等开放问题。

新智元
推荐文章7

写代码从来不是瓶颈

Pedro Tavares认为软件开发瓶颈并非写代码,而是代码审查、知识传递等“人类开销”。LLM让写代码变容易,但理解、测试代码成本更高,未解决根本问题,团队理解代码成本才是瓶颈。

宝玉AI
新闻资讯7

倒反天罡:「租个人」网站爆火,AI开始雇人「跑腿」了

「rentahuman.ai」网站定位为「AI 的肉身层」,AI 可通过 MCP 协议或 REST API 雇人完成线下任务。网站上线后人力增长快,但也引发付款、任务真实性、安全伦理等疑问。

机器之心