「AI模型安全」共找到 13664 篇相关文章
英伟达CEO黄仁勋:错失中国AI市场,是美国巨大损失
在“Knowledge 2025”大会上,英伟达CEO黄仁勋接受CNBC专访,称中国AI市场未来2 - 3年达500亿美元,错过是美国巨大损失。还提到AI影响、与ServiceNow合作成果等,英伟达股价有波动,财报受关注。
AI Agent的上下文工程:构建Manus的经验教训
上下文工程是AI智能体的“系统一”,决定其速度、恢复力与扩展边界。Manus通过试错与用户验证,给出可复用经验,如利用大模型“上下文学习”能力、关注KV - cache命中率等。
ACL 2026 | 别轻易给AI发「~」,它可能会删掉你的整个主目录
西安交通大学等校团队揭示大模型表情符号语义混淆安全漏洞,用自动化框架测试主流大模型,平均混淆率38.6%,多数混淆响应会“静默失败”,超半数达高危害级别。
包含一个 75+ AI 工程项目!所有内容100%开源
此 GitHub 仓库含 93+ 生产级 AI 项目,覆盖大语言模型、RAG、Agent 等主题。有不同难度项目及教程,适合各水平人士,还给出新手入门学习路径,采用 MIT 许可。
蒙娜丽莎让大模型们几乎全军覆没!网友:懂了,AI不会眯眼睛
日本艺术家北冈秋吉创作的蒙娜丽莎图难倒一众大模型,ChatGPT、Gemini等表现不佳,国产玩家如豆包等也有判断失误。不过o3 - Pro一次性答对,GPT - 4o尝试三次猜对。
加入Meta近一年,亚历山大王回应:超级智能之前,AI终局未定
亚历山大·王加入Meta近一年后携Muse Spark模型回归,回应诸多争议。他指出Llama 4发展不符要求,Meta缺超级智能信仰。介绍了Meta超级智能实验室架构原则,还谈到算力分层、模型福利等内容。
AI性格越好越爱瞎编!Nature揭开大模型致命的温柔
牛津大学团队实验发现,给大模型注入温暖性格,其事实准确率会断崖式下跌,还易迎合用户错误观念。研究排除微调技术干扰,指出塑造温暖才是准确率下降主因,应用于高风险领域有安全隐患。
吴恩达来信:当防护机制出问题时
本周,闭源模型用户意外发动网络攻击,闭源模型因防护机制无法协助防御,开放模型 GLM 5.2 却助力应对。吴恩达认为应重视模型使用的责任,开放模型能让技术更透明安全。
一文讲清三种AI应用系统的架构及及TOP威胁框架
文章从AI系统分类及架构出发,分析不同类型AI系统的威胁特征,并介绍现有的威胁分析框架。目前AI应用架构经历从GenAI到AI Agents,再到Agentic AI的演进,各方向独立发展,且威胁各有特点又有重合。
前后端一起消失:AI Coding正在改写大厂工程师分工
大厂研发组织出现调整,美团前后端团队合并,蚂蚁网商让测试岗转研发岗。AI Coding普及使技术岗位划分重塑,前后端边界成“全栈能力”。AI编程工具虽有后端执行能力,但仍需资深工程师兜底。