「Harness概念」共找到 492 篇相关文章
提示词压缩竟成大模型新漏洞?港科大提出黑盒攻击框架COMA | ASE 2026
香港科技大学研究发现,大模型的“提示词压缩”模块会重写系统安全边界,成为新攻击面。团队提出“对抗性信息损失”概念和COMA攻击框架,实验有效,还给出隔离压缩防御方案。
OpenClaw 类自主智能体生态构建
文章围绕OpenClaw类自主智能体生态展开,从生态视角、记忆系统、上下文管理等多方面阐述其构建,还分析了安全风险、治理体系、角色分工及面临的挑战与机会,为理解和发展Agent生态提供参考。
我手机里装了20个AI,最后发现只需要一个
AI工具爆炸,人们成了「AI项目经理」。百度DuMate在开发者大会展示强大能力,一句话可让三件不同工作并行执行,有技术架构支撑,已获认证且成本下降,入口之争本质是生态之争。
当 Kanban 不再管理人:Routa Kanban 如何管理 Agent Team
本文探讨了 Routa Kanban 如何管理 Agent Team,指出在 AI4SE 时代,多 Agent 协作进入日常软件交付需建设管理界面与工程护栏。Routa Kanban 把多 Agent 协作推进到‘管理驱动’,其价值在于将隐性约束显性化。
“龙虾”时代,大模型公司的好日子来了
3月10日,MiniMax港股收涨,市值超百度。OpenClaw爆火,其创始人转发评测榜单,使MiniMax-M2.1排名突出。OpenClaw是智能体构建框架,为大模型公司带来盈利转机,撬开收入天花板,引发各方关注。
打造高可靠 AI 助手:Skill 编排、Workflow 设计与 Spec Coding 的深度实践
文章拆解上下文工程五大实践模式,对比 Skill 与 Subagent 差异,介绍 Vibe Coding、Spec Coding。分析使用 Skill 做 AI Coding 的问题,提出 Workflow 概念及解决办法,还说明了工作流使用方法和适用场景。
OpenAI 智能体工程指南:10 条实战技巧和 3 种构建模式
OpenAI 给出智能体工程实战手册,介绍用技能、Shell 工具和上下文压缩三 API 让智能体稳定工作。全文涵盖概念、10 条实战技巧、3 种构建模式,有实用案例但数据精确度存疑。
这可能是我见过最“接地气”的 AI 科普:从家政阿姨看懂 Agent 和 MCP
作者以家政阿姨打扫卫生为例科普AI名词,如阿姨比作AI Agent,扫地机器人是SubAgent,智能家居协议对应MCP,《家政技能手册》为Skills,借此辅助解释常见AI概念,助读者理解。
ICCV 2025 | 港科、牛津大学发布AlignGuard,文图生成模型可规模化安全对齐框架
随着文图生成模型广泛应用,其安全防护机制有限。ICCV 2025上,港科、牛津大学推出AlignGuard,是文图生成模型可规模化安全对齐框架,通过生成CoProV2数据集等实现安全对齐,实验效果佳。
可攻可防,越狱成功率近90%!六大主流模型全中招 | EMNLP'25
研究人员聚焦大型语言模型(LLMs)安全漏洞,提出全新越狱攻击范式SCP与防御策略POSD。SCP基于DTD机制,在6个主流模型上平均攻击成功率达87.23%;POSD能有效抵御攻击,还提升模型泛化能力。