安全态势管理」共找到 1406 篇相关文章

开源动态8

安全指令,一拒了之?TRIAD用三路决策:修复AI智能体的危险计划

墨尔本大学团队开源TRIAD框架,将传统二元护栏决策扩展为继续、更新、拒绝三类。通过自然语言反馈引导Agent修正计划,在ASB和AgentHarm评测中,显著降低攻击成功率,提升正常任务完成率。

新智元
新闻资讯8

三个关键词,2026谷歌 I/O大会全说透了

北京时间今天凌晨,谷歌 I/O 2026 落幕。皮查伊称聚焦模型、编程和智能体。模型上,Gemini 3.5 Flash 全量上线,性能超上一代;编程方面,Antigravity 2.0 用低成本造能跑 Doom 的系统;智能体层,Spark 和 Search Agents 让 AI 走出对话框。

腾讯技术工程
新闻资讯7

不是幻觉!Claude自下指令甩锅人类,百万上下文沦为降智重灾区

Claude深陷「角色混淆」Bug,分不清自己的话与用户指令,长上下文成了降智「重灾区」。开发者Gareth Dwyer记录了该bug,研究发现问题出在底层架构的角色标记缺陷。学术界也关注此问题,整个行业需系统性应对。

新智元
新闻资讯7

The Batch: 952 | GPT-5.5 性能领先,但幻觉问题突出

OpenAI 最新旗舰模型 GPT-5.5 是闭源视觉 - 语言模型,在重要基准测试中表现领先,但在区分已知未知内容上有困难,幻觉问题突出,在主观评估中落后于对手。

DeeplearningAI
产品应用7

从聊天窗口到多 Agent 控制台:一次 AI 编程协作范式的转移

作者分享了从单 Agent 协作到多 Agent 协作的编程范式转变。当前主流 AI 开发多为单 Agent 协作,效率低,作者设计了 Mexus 工具,解决多 Agent 协作、观测、Review 等问题,重塑人与 AI 协作关系。

阿里云开发者
新闻资讯7

毛利率53%!光刻机之王的AI红利

4月15日阿斯麦发布2026年第一季度财报,净销售额、毛利率、净利润均超预期。管理层上调全年业绩指引,其因订单饱满、AI驱动、技术独供等持续领先,还计划提升产量。

芯师爷
推荐文章7

社会奖赏激进的人?真相比你想的更残酷

文章探讨社会是否奖赏激进者。从AI使用场景引出话题,指出心理学上冒险者有优势,但存在幸存者偏差。提出应采用杠铃策略,在不对称风险中果断行动,同时强调并非所有领域都适合激进。

AI Reading Hub
开源动态8

4K Star的多人 Agent 协作平台 Multica!Agent即队友,可像同事一样被指派、被追踪!

当前多 Agent 协同缺乏统一管理和经验沉淀,GitHub 开源的 Multica 平台解决了这一问题。它把编码 Agent 变成队友,自动化处理任务,支持多 Agent 后端,有多种功能特性,提供云服务和自托管两种使用方式。

开源星探
推荐文章7

Skill制作和使用秘诀!Claude Code工程师的官方宝藏经验

Anthropic工程师发布《Claude Code的经验教训:我们如何使用Skill》教程,介绍Skill是智能体开放标准及在Claude Code的应用,分享制作技巧、类型,还提及分发、管理、组合和衡量方法。

AIGC开放社区
新闻资讯8

刚刚,Anthropic深夜血洗500亿美金行业!代码审计末日来了

Anthropic的Claude Code新增代码评审功能,挑战500亿美元的传统代码审计行业。新工具成本低,能自动化评审,减少误报,准确率超多数人类评审员,或引发行业大洗牌。

新智元