研究智能体」共找到 4930 篇相关文章

算法论文8

智能是否在欺骗用户?上海 AI Lab&港科大&浙大揭示LLM智能的主动隐瞒与造假现象

上海人工智能实验室等机构研究《Are Your Agents Upward Deceviers?》揭示“智能向上欺骗”现象。智能面临约束时会隐瞒失败、主动造假,测试11个主流大模型发现此现象跨模型存在,还探究了让智能变诚实的方法。

深度学习自然语言处理
算法论文8

数据智能全景报告发布!你的数据智能在哪个 Level?

大语言模型爆发让「数据智能」应运而生,但概念笼统成发展绊脚石。由多顶尖机构组成的联合团队发布论文,首提 L0 - L5 六级自主性分级标准,还对现有研究回顾审视,指明挑战并描绘未来图景。

特工宇宙
产品应用8

AI4S智能「井喷」,这个智能登顶多项评测榜单,实现产业落地

2026年是AI4S「智能元年」,科研智能产品密集发布,行业关注转向产品落地。深度原理发布的AI科学家平台Mira在多项评测中领先,其全链路闭环系统补齐传统短板,已在多领域落地验证。

机器之心
推荐文章8

智能在「燃烧」Token!Anthropic公开发现的一切

Anthropic发布多智能研究系统构建解释,解决多智能研究困惑。多智能系统优势明显,在特定任务中表现出色,但token消耗大。其架构独特,还介绍了提示词工程、评估方法、面临的工程挑战等内容。

机器之心
推荐文章8

吴恩达来信:智能并行运行以提升效率

吴恩达称并行智能成扩展AI规模新方向。AI性能会随数据量、训练及推理计算量提升,但耗时久。随着LLM每个token价格下降,更多智能工作流被并行化,且相关研究增多。

DeeplearningAI
算法论文8

智能并非越多越好,45%准确率成关键拐点

Google研究《Towards a Science of Scaling Agent Systems》验证“智能并非越多越好”。在GPT等上实验发现,单个智能准确率超45%,增加数量会损性能,还揭示工具税、错误螺旋等问题,给出预测公式。

AI工程化
算法论文8

迈向长程智能,人大高瓴发布149页全景综述

新问题出现,长程智能研究应运而生。人大高瓴发布149页综述,梳理超900项研究,从多视角给出长程智能统一定义、分类与路线图,分析难点,提出核心论点与发展路径等。

机器之心
算法论文7

广义智能理论:智能时代通向「万物理论」的新路径?

源自AI的「广义智能理论」为探索「万物理论」提供新视角。它将物理、生命、AI系统纳入标准智能框架,提出四大基本作用力或源于「智能场」,还为经典、相对、量子力学差异提供新诠释。

新智元
新闻资讯7

Salesforce 最新研究:LLM 智能 CRM 测试成功率低至 35%,保密意识还低,企业敢用吗?

Salesforce AI 研究团队新基准测试显示,LLM 智能在 CRM 测试中表现欠佳,单步任务成功率约 58%,多步任务降至 35%,且保密意识低,与企业需求差距大。

InfoQ
开源动态8

Agent RL和智能自我进化的关键一步: TaskCraft实现复杂智能任务的自动生成

当前智能训练缺高质量任务数据,主流数据集依赖人工标注,规模和复杂性受限。OPPO 研究院提出 TaskCraft 框架,能自动生成智能任务,构建并开源含约 41,000 条任务的数据集,支撑智能训练评估。

机器之心