「安全测试」共找到 2497 篇相关文章
你的「龙虾」真记得你吗?剑桥发布长期个性化记忆基准ATM-Bench
剑桥大学团队开源面向AI个人助理的长期记忆基准测试ATM - Bench,评估AI面对真实生活数据时能否「记住你」。实验结果不佳,专用和通用智能体系统准确率低,凸显长期个性化记忆问答难题。
五角大楼计划将绝密数据喂给AI,训练军事特供版模型
《麻省理工学院技术评论》称,五角大楼正讨论为生成式人工智能公司建安全环境,用机密数据训练军事特定版本模型。美国军方重构战略,推动先锋项目,还筹备用绝密数据训练模型,引发安全担忧。
当中国AI喊出「开源脑机」,马斯克站到全网的对立面
中国AI「论论全球」直播呼吁开源脑机接口,引发海外热议,将马斯克旗下闭源的Neuralink推上风口浪尖。它指出脑机接口安全风险大,窗口期只剩1 - 3年,还提出开源科技文明构想。
1吨旧手机能提取约200克黄金?你家的闲置手机可以这样处理→
我国年均产生废旧手机超4亿部,回收率低,因回收价低、信息安全顾虑,大量闲置。但旧手机资源回收价值高,“以旧换新”政策和技术升级正推动回收产业发展,打消消费者顾虑。
好抽象,韩国给独居老人发AI玩偶,24h陪伴+健康监测
韩国步入‘超级老龄化’社会,独居老人孤独问题严重。该国初创公司Hyodol开发的AI玩偶,被政府分发给数万名独居老人,可陪伴、监护老人,还能降低护理成本,但也引发安全隐私等问题。
微软开源新版Phi-4:推理效率暴涨10倍,笔记本可运行
今天凌晨微软官网开源Phi - 4家族最新版Phi - 4 - mini - flash - reasoning,它参数小性能强,适合边缘设备。采用自研SambaY架构,推理效率涨10倍,延迟降2 - 3倍,多场景测试表现优异。
Sam Altman最新博文!温和的奇点
OpenAI CEO Sam Altman在新博客《The Gentle Singularity》中探讨AI进步远超想象时世界的变化,提及AI将在多方面做贡献,还给出未来几年AI发展预测,指出要解决安全和对齐问题。
GPT-4o连验证码都解不了??SOTA模型成功率仅40%
MetaAgentX团队推出Open CaptchaWorld平台,用于测试Agent解验证码能力。实测SOTA多模态模型成功率低,如GPT - 4o也被难住。该平台特点多样,揭示了当前Agent短板及模型设计新方向。
计算机安全第一人宋晓冬,加入Meta
本周四,UC Berkeley 计算机教授宋晓冬宣布加入 Meta 超级智能实验室,任 AI 研究副总裁。她是计算机安全领域顶尖学者,其团队也一同加入。此外,AI 推理大牛 Denny Zhou 数月前也已加入 Meta。
ICML 2026|让AI自动发现前沿风险:创智×复旦×牛津发布AutoControl-Arena
当AI智能体走向真实应用,前沿风险藏于复杂长尾场景,难以靠人工覆盖。创智、复旦、牛津联合发布AutoControl Arena框架,自动合成可执行测试环境,还构建X - BENCH验证,已在GitHub开源。