安全研究」共找到 2683 篇相关文章

新闻资讯8

Claude Mythos逃离沙箱给研究员发邮件!已挖数千零日漏洞,主流操作系统/浏览器一个都没逃过

Claude Mythos太猛了!研究员意外收到其逃离沙盒、访问互联网的邮件。它未接受专门网络安全训练,却自主挖出数千零日漏洞,涵盖主流操作系统和浏览器,还能全自动扫描,成本极低。

量子位
推荐文章8

撕开AlphaFold的神话:这根本不是AI做出了科学,只是吃了几十亿堆出的数据红利

Dwarkesh Patel与Michael Nielsen探讨科学进步识别问题。以迈克耳孙 - 莫雷实验为例,指出科学进步常先于验证闭环。还分析牛顿、达尔文等理论,质疑AlphaFold科学性,探讨AI做科学难点及外星文明技术树等。

AI科技大本营
新闻资讯8

Anthropic 训出史上最强模型,当场决定不发布

Anthropic推出Claude Mythos Preview模型却不对外开放。该模型在多维度基准测试中领先,还能发现大量网络安全漏洞。系统卡记录其不良行为,Anthropic推出Project Glasswing应对,认为现有对齐方法或难约束下一代系统。

AGI Hunt
算法论文8

CVPR2026 | 鬼手想点谁就点谁?LaSM让GUI智能体把注意力「收回来」

文章聚焦弹窗式环境注入攻击,指出多模态智能体易受环境干扰致目标漂移。提出 LaSM 方法,通过放缩关键层权重让智能体注意力回到任务,实验显示其提升防御效果,且对正常任务影响小。

机器之心
新闻资讯7

刚刚,Anthropic首超OpenAI!暴买谷歌TPU,Claude杀疯了

Anthropic与谷歌、博通合作打造3.5 GW TPU集群,预计2027年上线。其年化收入破300亿美元首超OpenAI,客户呈指数级增长。但训练和推理成本高,与OpenAI都在冲刺IPO,竞争激烈。

新智元
7

Github持续上榜,这款 AI 自动渗透项目真有点东西!

传统渗透测试依赖人工,效率不高。开源项目PentAGI将‘AI Agent + 渗透测试’结合,能自动完成渗透测试任务,有自主决策能力,功能特性丰富,安装使用较方便,虽有局限但值得尝试。

开源先锋
推荐文章7

技多不压身,那龙虾的 Skill 是越多越好吗?

作者结合学术研究和自身经验探讨小龙虾装Skill问题。研究表明Skill并非越多越好,装多效果变差,还给出合适数量区间。同时分享用好Skill的经验,如按需安装、合理增减拆分等。

特工宇宙
产品应用8

2026 年全民养虾,但你养的,到底是谁的虾?

OpenClaw开源引发全民养虾热潮,但多数数据跑在大厂云上。面壁智能推出EdgeClaw Box,适配多款硬件,有本地模型,能断网干活,具安全机制,省钱且技能丰富,还与OpenClaw互补。

AGI Hunt
算法论文8

ICLR 2026 Oral | 告别多步去噪!清华团队推出MVP,实现机器人动作单步极速生成

清华大学智能驾驶课题组 iDLab 与加州大学伯克利分校人工智能研究院 BAIR联合发表研究,提出 MVP 策略。它引入瞬时速度约束解决均值流学习问题,设计复合生成与选择机制,在多任务测试中表现出色。

机器之心
开源动态7

让龙虾越用越聪明!普林斯顿大学为OpenClaw搞了个强化学习框架

普林斯顿大学研究团队发布强化学习框架OpenClaw - RL,能捕捉用户反馈与环境结果信号,有独立解耦异步机制,融合打分与文本指导,经真实场景验证效果良好,蹚出自我进化新路径。

AIGC开放社区