LLM智能体」共找到 4189 篇相关文章

算法论文8

给定"标价"的 LLM 智能,能规划出"最优"路径吗?

LLM智能体多轮工具使用中,评估成本是难题。来自多所高校的团队推出CostBench基准,围绕旅行规划构建评估环境。评估顶尖模型发现其规划与适应能力有短板,并分析失效根源,还指出下一代智能演进方向。

深度学习自然语言处理
算法论文8

智能是否在欺骗用户?上海 AI Lab&港科大&浙大揭示LLM智能体的主动隐瞒与造假现象

上海人工智能实验室等机构研究《Are Your Agents Upward Deceviers?》揭示“智能向上欺骗”现象。智能面临约束时会隐瞒失败、主动造假,测试11个主流大模型发现此现象跨模型存在,还探究了让智能变诚实的方法。

深度学习自然语言处理
算法论文8

AgentAuditor: 让智能安全评估器的精确度达到人类水平

LLM智能体进化为“行动派”,但自主权带来安全问题。现有评估基准缺乏有效精准评估器,研究者推出AgentAuditor框架及ASSEBench基准,让LLM评估器精确度达人类水平,为构建可靠智能提供工具。

机器之心
算法论文8

上海交大团队发布首篇「搜索智能」综述!四个维度深度剖析搜索智能

上海交大团队发布首篇「搜索智能」综述,从如何搜索、优化、应用、评估四个维度剖析。随着LLM兴起,搜索从传统模式向搜索智能转变,虽有潜力但缺统一研究视角与评估框架,该综述提供了路线图。

AI科技评论
新闻资讯8

微软 Build 2025:AI 智能时代与开放智能网络的构建

微软 Build 2025 大会展示迈向 AI 智能时代路径,如发布新功能助力开发者,让 AI 智能更强大安全,支持开放智能网络,还推出平台加速科学发现。

AIGC开放社区
产品应用8

无问芯穹首曝智能服务平台,以基础设施加速企业级「智能自由」

12月16日,无问芯穹在智能生态论坛发布智能服务平台。该平台为企业提供全链路陪伴式落地服务,解决生产级智能落地和规模化的难题,助力企业实现智能的高效商业化落地与可持续运营。

机器之心
推荐文章8

IJCAI 研究卓越奖得主 Nick Jennings:一个智能的聪明,不如一群智能的相遇|IJCAI 2026

8月18日,IJCAI 2026大会上,研究卓越奖得主Nick Jennings回顾智能发展历程,指出当下智能AI火热,它并非新概念,而是经数十年积累。还分享经验,展望从智能智能社会的未来。

AI科技评论
产品应用8

AI4S智能「井喷」,这个智能登顶多项评测榜单,实现产业落地

2026年是AI4S「智能元年」,科研智能产品密集发布,行业关注转向产品落地。深度原理发布的AI科学家平台Mira在多项评测中领先,其全链路闭环系统补齐传统短板,已在多领域落地验证。

机器之心
算法论文8

ACL'25 | 多智能叛变进行中?首个多智能安全守卫G-Safeguard亮相!

随着基于LLM的多智能系统崛起,其安全隐患凸显。中国科学技术大学等机构提出G - Safeguard安全防护框架,它基于图神经网络,通过构建多智能话语图等方式,能有效抑制恶意信息传播,有强大防御和泛化能力。

PaperAgent
推荐文章8

吴恩达来信:智能并行运行以提升效率

吴恩达称并行智能成扩展AI规模新方向。AI性能会随数据量、训练及推理计算量提升,但耗时久。随着LLM每个token价格下降,更多智能工作流被并行化,且相关研究增多。

DeeplearningAI
上一页1 / 419下一页