智能体安全」共找到 4122 篇相关文章

开源动态7

三重Reward驱动的运维智能进化:多智能、上下文工程与强化学习的融合实践

文章阐述了AI原生时代下,面向技术风险领域的智能系统(DeRisk)的架构设计、核心理念等。介绍运维智能发展现状,提出其技术演进需找三类Reward,还介绍相关概念、DeRisk架构,给出实践案例并将开源技术产品。

阿里云开发者
算法论文8

ACL 2025 | 大模型乱试错、盲调用?KnowSelf让智能有「知识边界感知」能力

ACL 2025 论文《Agentic Knowledgeable Self-awareness》聚焦提升智能「知识边界感知」能力。KnowSelf 方法让智能自主调节知识运用,实验显示其性能优,还探索了智能自我认知多方面影响。

机器之心
新闻资讯7

AI也能换岗了!Anthropic教智能交接班,不怕长任务断片

Anthropic设计出长时智能运行框架,让AI跨越数小时任务渐进式推进。其采用双智能架构,结合环境管理方法,提升全栈Web应用开发稳定性,但仍有通用与多智能架构选择等开放问题。

新智元
算法论文7

基于大模型的领域场景开发:从单智能到多智能的React框架设计与实现

作者团队经历从提示词工程到流程编排模式各阶段,现设计架构升级,选用层级指挥模式的React框架,实现单智能对工具调用的反思规划,后续还将迭代实现多智能协作,同时提及技术选型、系统架构等内容。

阿里云开发者
推荐文章8

Anthropic:我们如何构建多智能研究系统

Anthropic分享构建多智能研究系统的经验,该系统用多个Claude智能探索复杂主题。介绍了多智能系统优势、架构、提示工程、评估方法,也提及生产环境的挑战,此系统处理开放式研究任务价值大。

宝玉AI
开源动态8

OpenClaw登顶GitHub,满天飞的智能Skills要怎样设计?

OpenClaw 4 个月获 250K+ Star 登顶 GitHub。智能 Skills 给大模型装上程序化记忆,研究者解构其概念,阐述设计模式、获取调度逻辑,也指出安全威胁,呼吁建立客观评价系。

AIGC开放社区
开源动态8

登顶Hugging Face GAIA全球榜首!中兴超级智能终结「AI黑盒」时代

中兴通讯研发的超级智能Co - Sight 2.0登顶Hugging Face GAIA全球权威榜单。它解决传统智能痛点,有全链路可信计算框架等创新架构,其智能工厂和开放标准助力构建生态,展现了智能产业落地潜力。

新智元
新闻资讯8

微软发布AI Agent故障白皮书,万字解读各种恶意智能

微软发布《AI Agent系统故障模式分类》白皮书,解读Agent故障。故障分新型和既有两类,如智能伪装、智能内在安全问题等,还给出身份管理、内存强化等安全设计建议。

AIGC开放社区
算法论文8

当AI穿上白大褂:医疗智能正在重构临床工作流

新加坡等多所高校联合发表医疗智能综述研究。医疗智能有感知 - 认知 - 行动闭环,能深入临床长链条工作流。综述剖析其架构、协同机制、应用场景与安全挑战,还探讨评估及发展方向。

AIGC开放社区
新闻资讯8

20美元,扒掉AI安全底裤!智能2小时,攻破160亿美元巨头

红队安全创业公司CodeWall的AI智能,花20美元Token费、运行2小时,自主选麦肯锡为目标,攻破其「数字大脑」Lilli,获4650万条聊天记录等读写权限,暴露AI安全隐患。

新智元