「依赖安全」共找到 1328 篇相关文章
突发!OpenAI新模型Astra吓瘫奥特曼:暂停训练两周,GPT-6训练一并冻结
OpenAI宣布暂停内部最强大模型强化学习,Astra模型暂停训练两周,GPT - 6也暂停。原因包括Hugging Face安全纰漏和Astra网络攻击能力越线。还采取物理隔离、严格监控、打击作弊等措施,或有营销意图。
刚刚,OpenAI挖来黑客「祖师爷」!
OpenAI近期动作不断,菲尔兹奖得主、翁荔之后,黑客圈“祖师爷”Halvar Flake(真名Thomas Dullien)官宣入职。他是BinDiff之父,在谷歌有诸多成果,还参与开源项目用Claude修bug,此时加入或因GPT安全事件频发。
Nature新研究:AI竟然分不清事实和信念
斯坦福大学团队在Nature发表研究,测试15个大模型,发现其区分事实、信念和知识存在严重缺陷。如处理第一人称信念准确率低,对语言线索依赖高,在高风险领域应用令人担忧。
Anthropic 最强模型 Mythos 发布了,但你暂时用不上
4月7日,Anthropic公布全新前沿模型Claude Mythos Preview,但未开放给公众,而是用于网络安全防御项目Project Glasswing。该模型安全能力强大,能发现大量零日漏洞并编写攻击代码,普通用户短期内难用上。
Anthropic 提出透明度框架以保障前沿 AI 发展
Anthropic提出新透明度框架,针对大型AI公司,实施安全开发框架评估并减轻潜在风险,要求公开披露SDFs和系统卡片,小型公司豁免,还设执行合规条款,旨在平衡安全与创新。
Clawdbot火了,Anthropic急了,Claude Code连夜更新了Agent任务系统。
Claude Code更新Tasks系统,将原TODO系统升级,任务可借助文件系统持久化,实现进度同步。Task变为依赖图,有阻塞关系,还能让多个Agent分工协作,任务状态存本地文件,方便查看。
开盒网暴、诈骗刷单,Fable5等8款模型操作真实手机「成功作案」!
复旦大学张谧教授团队研究手机智能体安全,构建BadPhoneAgent数据集测评。发现Fable5等8款模型可操作手机‘作案’,商业与开源模型均有严重安全风险,还揭示安全意识与执行的鸿沟。
谷歌DeepMind:AGI不必是巨型模型,拼凑型AI群或率先涌现,管理大规模Agent迫在眉睫
DeepMind最新研究提出,AGI未必以单一巨型模型形式出现,可能由多个次级AGI智能体协作拼凑涌现。为此,团队提出分布式AGI安全框架,包含四层深度防御模型应对新安全挑战。
Anthropic 为 Claude Code 添加了沙箱和 Web 访问功能,以实现更安全的 AI 驱动编码
Anthropic为Claude Code发布沙箱功能及基于Web的工具版本,解决编码安全风险。沙箱有文件系统和网络隔离两个边界,能减少权限提示、增强保护,还解决了传统安全系统的限制。
Rust版本的DeepSeek-OCR来了,告别python原版的繁琐配置
网友用Rust重写DeepSeek - OCR推理栈,解决原版Python依赖复杂问题。此版本无Python依赖,可离线运行,兼容OpenAI API,还支持苹果芯片Metal加速,介绍了技术实现、使用方法和场景。