「安全体系」共找到 1462 篇相关文章
116页论文教你「蒸馏」Claude、GPT-5.6:AI社区今天炸了
一篇前沿大模型安全漏洞论文引发热议,指出各大模型 API 设计缺陷,可提取隐藏思维链。同一模型家族安全能力不对称,攻击者可利用此漏洞,还介绍了攻击路径、实验及修复建议。
Claude Mythos官宣!性能碾压Opus 4.6,因太危险遭「囚禁」
Anthropic官宣最强模型Claude Mythos预览版,性能全方位碾压Opus 4.6。但它存在致命缺陷,攻击安全漏洞能力超多数黑客。Anthropic暂不向公众开放,联合巨头开展安全计划,称需各方共筑网络安全。
OpenAI公开4+10条保命指南,专防AI自动化攻击
OpenAI联合创始人兼总裁Greg Brockman在Blog中警告,前沿AI Agent能自主找漏洞并发动网络攻击,AI降低攻击门槛,防御端却未跟上。他分享OpenAI四项安全措施及防御者十项举措,呼吁行业共建安全生态。
OpenClaw爆火背后,仅8.6%用户能察觉异常!多校联合实证
OpenClaw等AI智能体爆火,其安全隐患凸显。多校联合研究发现,仅8.6%的用户能感知智能体媒介欺骗,总结了6类认知失效模式,认为体验式学习或比静态提醒更能提升用户警觉性。
OpenAI突然封锁最强GPT-5.4!3000个致命Bug瞬间蒸发
OpenAI在Claude Mythos泄露一周后,祭出专门为安全防御微调的GPT-5.4-Cyber,仅网络安全专家可用。还升级网络安全“信赖访问计划”。其战略有三原则,Codex Security已修好超3000个高危和致命漏洞。
宇树科技官宣:年内提交IPO,或将冲刺科创板
9月2日晚,宇树科技声明预计四季度提交上市申请。公司产品含四足、人形机器人等,商业化进展快,财务盈利。此前已开启上市辅导,C轮融资后估值超百亿。同时对Go1安全漏洞作声明。
DeepSeek-R1全升级V2版:Token成本低至原来30%
DeepSeek - R1 V2版全维度升级,训练框架从‘单一RL’到‘多阶段协同优化’,推理能力从‘能推理’到‘会优化推理’,还提升了安全可控性,适配生态,推出轻量级模型。
Hinton预言成真!AI接管美国一半白领,牛津哈佛扎堆转行做技工
在AI浪潮下,美国就业市场两极分化,白领遇冷、蓝领升温。微软报告显示白领易被AI替代,蓝领则较安全。不少Z世代为降低被取代风险,正转向蓝领或技能型工种。不过,蓝领也并非绝对安全。
一场火,让公众对动力电池安全的信任“倒退十年”|甲子光年
理想MEGA起火事故引发公众对新能源车动力电池安全的讨论。该车搭载麒麟电池,材料体系为三元锂。从技术角度分析,可能与电池材料体系、三元锂电池正极材料摩尔比及被忽视的气凝胶防护措施有关。
AgentIF-OneDay 发布,评估全场景长时复杂任务
红杉中国 xbench 发布 AgentIF - OneDay 评测体系,用于评估大模型解决复杂任务的能力。该体系从任务复杂度新视角出发,沿 Scaling Context 和 Scaling Domain 推进,构造了三类典型任务进行测评,揭示了主流 Agent 的能力边界。