「工程防御体系」共找到 1350 篇相关文章
突破Claude-4编程上限!自进化Agent框架拿下新SOTA,底模越好性能越高,已开源
中科院、清华等提出SE - Agent自进化框架,突破Claude - 4编程上限。它让智能体系统性修订、重组与精炼思考过程,在SWE - Bench Verified上刷新开源框架SOTA,已开源。
商汤林达华万字长文回答AGI:4层破壁,3大挑战
在WAIC 2025上,商汤发布国内首个实现“图文交错思维”的商业级大模型日日新6.5。商汤科技联合创始人林达华发文,剖析多模态通用智能实践,解答AI领域关键问题,提供通往AGI的参考。
模型即 Agent 的含金量:Kimi深度研究功能详评
作者分享Kimi深度研究功能体验。其基于端到端自主强化学习技术,会开源模型。在测试中,分析Labubu爆火原因、检索小米发布会内容,展现出强逻辑分析、搜索准确性和数据处理能力,可视化网页也出色。
MMAR与AudioTrust技术解读,音频大模型评测前沿进展分享 | AI Bench Talk直播预告
司南评测集社区 CompassHub 收录多维度评测集。此次 AI Bench Talk 直播聚焦音频大模型,将分享评估其深度推理能力的 MMAR 及全方位可信评估框架 AudioTrust,还设圆桌讨论多模态/音频大模型相关议题。
间接提示词注入攻击(IPIA)原理、方法及案例
本文介绍间接提示词注入攻击(IPIA),它于2023年5月被认定,通过恶意三方数据攻击,适应性广。文中阐述攻击过程、方法,还以Mavy GPT日历泄露为例说明,指出虽有防护但攻击仍会持续。
DeepMind 提出 CaMeL,抵御 LLM 提示词注入
谷歌DeepMind研究人员提出CaMeL,作为围绕LLM的防御层,通过提取查询中的控制流和数据流阻止恶意输入,能在AgentDojo基准测试中抵御67%攻击,采用传统软件安全原则。
美团反思“养虾”日耗上千万元、干扰真实经营,龙虾之父自曝:爆火后差点删掉整个项目
今年2 - 3月美团开展“养虾运动”,引入OpenClaw,日耗上千万元还干扰经营。美团CEO王莆中复盘称这是AI转型第一阶段。OpenClaw之父Peter也复盘爆火8个月经历,分享经验与感悟。
DeepSeek Harness 入选项目疑似曝光,不选万星「花瓶」,死磕 Agent 基建
昨晚 DeepSeek V4 Pro 发布,欲迈向“工业级 Agent 生产线”。网上爆出 DeepSeek Harness 内测入选项目名单,筛选重实用功能,多集中在 MCP 插件、Coding Agent 等赛道,还介绍了部分入选项目及战略意图。
谁不想要一条会飞的鱼呢?他们造了个会捣蛋的机器人,拿下了最佳论文奖
庆应义塾大学徐铭阳和香港城市大学李彦衡发表论文Floating Companion,获ACM DIS 2026最佳论文奖。他们研究软体浮空机器人,探讨其与人的关系、交互可能,虽面临浮力 - 质量循环等挑战,但对其未来充满期待。
4万字《壮丽人性》长文首发!教皇联手Anthropic,警告AI不能统治人类
2026年5月25日,教皇良十四世发布42300字AI通谕《壮丽人性》。Anthropic联创称大模型涌现人类情绪,人类无法理解。教皇指出AI核心危机,揭露剥削与数据殖民,反对AI用于战争,关注AI对工作的冲击。