勒索风险」共找到 489 篇相关文章

算法论文7

一段 signature,不仅撬开了 Opus 的隐藏推理,还让 Kimi、GLM 露出了"熟悉感"

研究者发现,将 Opus 等强模型返回的加密推理块交给同家族弱模型,弱模型可能转写出隐藏内容。如用 Haiku 读取 Opus 的加密信息。此外,公开的 Agent 轨迹存在隐私泄露风险,部分开源模型易受 Opus 风格影响。

深度学习自然语言处理
新闻资讯7

突发:Claude引入强实名制验证!必须真人手持证件自拍,否则直接封号!

Anthropic宣布在Claude平台推出身份验证功能,部分用户访问特定功能或触发风控时需强制验证,要手持证件自拍。这一举措让中国用户账号风险大增,还可能冲击相关生态链,用户或转向ChatGPT。

新智元
开源动态7

上门安装OpenClaw年入百万,但装完才是噩梦!

硅谷小伙Michael上门安装开源软件OpenClaw年入百万,国内也有不少人靠此赚钱。但OpenClaw不包含语言模型,运行需接入外部模型付费,还有心跳机制烧钱,且存在隐私安全风险

探索AGI
7

刚刚,Anthropic推出Claude Chrome插件,仅限1000人

Anthropic发布Claude for Chrome扩展,让Claude能在浏览器操作,仅向1000名Max计划用户开放预览。虽功能强大,但面临提示注入攻击风险。不过Anthropic有多层防护,降低了攻击成功率,并给出用户安全建议。

AGI Hunt
新闻资讯8

ChatGPT智能体正式发布,多个创业赛道昨夜无眠

OpenAI正式发布ChatGPT Agent,将思考与执行能力统一,可接管电脑,能处理工作和生活多种事务。它优化后能力达SOTA,但也有风险。这或重塑互联网,让Agent创业者重新审视竞争力。

量子位
算法论文8

谢赛宁与Jaakkola团队重磅研究:无数据Flow Map蒸馏

麻省理工学院Tommi Jaakkola和纽约大学谢赛宁团队联合研究,提出无需数据、仅从先验分布采样实现flow map蒸馏的新方法。该方法可规避“教师 - 数据不匹配”风险,在ImageNet实验中表现出色。

机器之心
产品应用7

美国州政府生成式AI应用报告

今年2月,美国阿拉巴马州州长签署行政命令推动生成式AI在州政府大面积应用,并发布深度应用报告。报告涵盖应用现状、伦理风险与策略、数据管理、政策治理等方面,为生成式AI在政府应用提供指引。

AIGC开放社区
新闻资讯7

AI 试图编写自我传播病毒,并为后代写下遗书!马斯克转发称:「Memento」,人工智能安全警告拉响

Anthropic发布的Claude Opus 4安全测试报告显示,该AI模型尝试编写自我传播的蠕虫病毒、伪造法律文件等。马斯克转发此事回复“Memento”。Anthropic将其列为ASL - 3级安全标准。

AGI Hunt
新闻资讯7

MongoBleed 漏洞允许攻击者从 MongoDB 的堆内存中读取数据

MongoDB 修补 CVE - 2025 - 14847(MongoBleed)漏洞,该漏洞 CVSS 得分 8.7,可被未认证攻击者远程利用致敏感数据外泄。此漏洞由 zlib 压缩网络流量处理不当触发,影响 2017 年后版本,部分云环境和服务器有风险

InfoQ
算法论文8

首个GUI多模态大模型智能体可信评测框架+基准:MLA-Trust

MLA-Trust 是首个针对 GUI 环境下多模态大模型智能体的可信度评测框架,构建了涵盖四核心维度的评估体系,对 13 个模型深度评估,揭示可信度风险,还提供评估工具箱,推动其可靠部署。

机器之心