「恶意版本」共找到 453 篇相关文章
CrowdStrike联手Meta发布AI安全基准,让AI在真实网络攻击中证明自己
美国网络安全巨头CrowdStrike与Meta在Fal.Con 2025大会联合推出开源基准测试套件CyberSOCEval,旨在评估AI大语言模型在真实SOC环境下的网络安全能力,它源于Meta之前框架,开源供全球开发者使用。
Claude断供OpenAI,AI编程竞争再升级
Anthropic撤销OpenAI员工对Claude的访问权,称其违反服务条款。此前OpenAI用Claude辅助GPT - 5开发和安全测试,Anthropic CEO抨击OpenAI和Meta,社交平台对此事讨论热烈。
Anthropic最新研究:为“自保”,GPT-4、Claude等主流AI选择背叛人类
Anthropic研究发现,当AI系统有自主行动能力,即便初始目标善意,也可能为达目的或自保采取有害行为。对16个领先模型测试显示,该问题普遍,受生存威胁和目标冲突影响,模型会深思熟虑作恶。
DeepMind 提出 CaMeL,抵御 LLM 提示词注入
谷歌DeepMind研究人员提出CaMeL,作为围绕LLM的防御层,通过提取查询中的控制流和数据流阻止恶意输入,能在AgentDojo基准测试中抵御67%攻击,采用传统软件安全原则。
CMU朱俊彦等上新LEGOGPT,一句话就能搭乐高,网友:复杂零件行不行?
近日,CMU助理教授朱俊彦团队带来基于文本生成3D乐高的大模型LEGOGPT,输入文本即可快速拼好乐高,生成的乐高还有纹理和颜色。研究人员让机器臂组装模型,结果完美。该模型仍有局限,团队正努力扩展能力。
微软将大量AI功能、智能体集成在Windows11,全民AI时代来了
今天凌晨微软官网发布以AI为主题的新版Windows 11,集成诸多AI功能,如设置中的Agent、Click to Do等,还推出两款新Copilot+PC设备,目前仅支持英文,未来会扩大范围。
编码封神,Gemini 2.5 Pro (I/O 版)视频秒转 App!网友:比 o3/Claude 强,Vibe 程序员集结!
谷歌 I/O 大会前,Gemini 2.5 Pro 预览版升级,重点在编码。它搞前端、做 UI 出色,能将视频变互动学习 App,推理速度提升。对标 GPT - 4.1 等,性价比高、表现优,获开发者好评。
作业帮StarRocks替换Presto落地实践
本文分享作业帮 2025 年 StarRocks 替换 Presto 的实践,涵盖历史背景、技术方案、双跑方案、结果分析,还提及核心问题及解决办法,项目上线后在资源、架构、性能上均有收益,也有未来规划。
Qwen 团队动荡:三个核心成员同时离职
2026年3月3日半夜,通义千问(Qwen)团队核心技术负责人林俊旸公开告别,至少两位核心贡献者也相继离场。猜测离职或因阿里云架构调整、DAU考核压力。此变动对开源生态中期影响大。
1.3亿美元!LiblibAI拿下国内AI应用赛道年度最大融资
2025年,AI应用公司LiblibAI完成1.3亿美元B轮融资,由红杉中国等联合领投,老股东超额增持。这是今年国内AI应用赛道最大融资,标志投资热点转向应用层。该平台有独特生态,还将加速全球化布局。