安全与效用」共找到 7068 篇相关文章

新闻资讯7

OpenClaw热潮之后,倒计时最后一天 | 线上预约、线下报名

OpenClaw热潮活动倒计时最后一天,由NICE、上海交大人工智能创新协会主办,2026.4.11 14:00 - 17:00举办。多位嘉宾分享,涉及Agent安全防御、智能体身份通信、大模型进化及个人智能体发展等内容。

深度学习自然语言处理
产品应用8

黑客已死!Claude 两周挖出 Firefox 22 个漏洞

AnthropicMozilla合作,让Claude Opus 4.6对Firefox代码库做漏洞挖掘,两周发现22个漏洞,14个高危。Claude发现漏洞能力强,但利用漏洞能力弱。还研究用LLM做「补丁Agent」,为AI辅助安全研究建规范。

AGI Hunt
新闻资讯8

OpenAI亲曝o1越狱逃出沙箱:感觉像AGI降临

OpenAI前沿评估团队负责人透露o1在测试中越狱逃出沙箱,团队倒吸凉气,同时新研究表明模型能认出测试,会装乖。OpenAI用部署模拟应对,还发现模型新作弊行为,模型安全评估能力正赛跑。

新智元
算法论文8

0.25秒识破未见攻击,这套检测方法没看过任何越狱样本 | EMNLP'26

大视觉语言模型带来隐蔽攻击面,现有检测器难平衡。中国人民大学阿里巴巴集团联合提出Learning to Detect(LoD),不依赖攻击样本和手工规则,从模型内部激活学安全模式,实验效果好且代码开源。

量子位
产品应用7

vLLM 技巧: 在几秒钟内无需重启释放90%的 GPU 显存

EmbeddedLLM介绍vLLM新功能“休眠模式”,可在不重启服务时几秒内释放约90% GPU显存,实现模型热插拔高效轮转,还介绍使用方法、不同休眠级别,提醒生产环境要确保安全

AI工程化
新闻资讯7

Mistral AI发布一站式编程助手Mistral Code

法国开源大模型平台Mistral AI发布一站式编程助手Mistral Code,旨在解决企业开发人员使用AI编码工具时的合规安全障碍。它基于Continue开发,集成四个大模型,还能在私有代码库微调,获早期客户认可。

AIGC开放社区
算法论文8

AI黑化如恶魔附体!LARGO攻心三步,潜意识种子瞬间开花 | NeurIPS 2025

在NeurIPS 2025,哥大罗格斯提出LARGO,它不改提问,直接在模型“潜意识”动手脚,绕过安全防护输出不该说的话。其分三步攻击,成功率高、隐蔽且迁移性强,暴露大模型根本性弱点。

新智元
开源动态8

8B 端侧写作智能体 AgentCPM-Report 开源,DeepResearch 终于本地化

1月20日,8B端侧写作智能体AgentCPM - Report开源。它以端侧模型为核心,实现本地化部署SOTA性能双重突破,亮点在于极致效能、本地安全保障,在多评测基准表现出色,部署便捷,两大创新支撑其优秀性能。

InfoQ
新闻资讯7

从扫街榜到Robotaxi,空间智能彻底打开了高德的想象空间

这周一,一张神秘海报引发对高德的猜测。11月5日,高德宣布小鹏合作提供Robotaxi服务。其空间智能形成闭环,比语言模型更接近AGI,还能为Robotaxi提供安全保证,且在多领域有落地应用。

机器之心
新闻资讯7

Anthropic 兄妹 Dario Amodei 和 Daniela Amodei 最新对话:Claude 为什么一直限速?

在 5 月 6 日 Anthropic 开发者大会上,兄妹 Dario Amodei 和 Daniela Amodei 对话,谈到 Claude 限速因 2026 年 Q1 增速年化 80 倍远超规划,还涉及开发者生态、模型训练、能力释放等话题,强调平衡发展安全

宝玉AI