「安全测试」共找到 2497 篇相关文章
OpenAI解散「灾难风险应急」团队!GPU大神Scott Gray也跑路了
OpenAI解散「Preparedness」团队,该团队负责评估自家AI灾难级社会风险。官方称安全工作已融入开发流程。此前多个安全团队也已解散,多名安全高管离职,引发员工不安。
Stripe 发布基准测试:AI 智能体可开发集成方案,但校验环节存在短板
Stripe推出基准测试套件,评估AI智能体构建完整Stripe集成方案的能力,测试聚焦金融系统贴近生产环境的集成场景。测试显示,不同任务类型评测结果差异显著,核心瓶颈在于验证环节,当前智能体短板在校验逻辑等方面。
BIGAI & 中科大团队提出 MILR: 测试时隐空间推理,让图像生成学会「边想边改」丨ICLR 2026
BIGAI与中科大等团队提出MILR,通过测试时隐空间推理,在不更新模型参数下优化图文表示,提升复杂图像生成能力。该方法在多基准测试达SOTA,还探讨了测试时扩展与奖励模型,未来有诸多拓展方向。
Replit 怒锤“欧洲版 Cursor”:造出百款“高危”应用,普通开发者一小时内黑入,氛围编码成了黑客“天堂”?
近日,Replit 员工报告 Lovable 未修复关键安全漏洞,扫描发现其百款应用高危,普通开发者一小时内可黑入。Lovable 虽推出‘安全扫描’功能,但仍未解决底层问题,引发对氛围编码安全责任的讨论。
1亿美元买不走梦想!但只因奥特曼这句话,他离开了OpenAI
全球AI军备竞赛烧掉3000亿美元,但真正研究「对齐问题」的人不足千人。Anthropic核心成员Benjamin Mann揭秘,2020年底OpenAI安全团队因安全优先级降低集体出走。他拒绝扎克伯格1亿美元邀约,强调AI要把安全放首位。
Anthropic重磅更新skill-creator:创建skill全面告别“草台班子”时代
Anthropic升级skill - creator,让普通人创建skill更友好且有效。将测试等机制引入创作,能验证skill有效性。还支持多智能体并行测试、A/B测试,优化触发描述,为未来自然语言定义skill过渡。
Cloudflare 如何解决了 quiche 中的一个拥塞漏洞
Cloudflare 分享发现 CUBIC 的 Rust 实现问题,该问题影响开源库 quiche。团队构建模拟环境测试,发现 CUBIC 陷入恢复循环,用 Reno 测试排除广泛问题,最终一行代码修复,使测试通过率达 100%。
389万寻找翁荔继任者!OpenAI紧急开招安全防范负责人
OpenAI在连遭安全指控后,豪掷约389万元+股权急招安全防范负责人,要制定执行安全防范框架。此前其安全团队负责人更迭频繁,此次招聘是否‘应激之举’待商榷。
智能体的致命三要素及六种安全设计模式
智能体发展带来诸多安全问题,仅靠外部防护不合理。Simon Willison总结其致命三要素,指出间接提示词注入攻击难防。Invariant Labs等提出六种安全设计模式,可综合使用,多LLM方法值得关注。
Anthropic "泄露"Claude Mythos 最强模型到底有多猛?
Fortune爆出Anthropic因CMS配置失误,致新模型Claude Mythos信息泄露。该模型有阶跃式进步,在多领域表现超前代,网络安全能力突出。此事反映AI迭代快但安全待提升,安全成模型评估关键。