「安全治理」共找到 997 篇相关文章
看一眼代码就中毒?Clawdbot惊现隐形越狱,AI工具变黑客
Clawdbot多次改名仍火爆,斩获10万GitHub星标。它适应性强,低配置硬件也能运行,可用于多种应用。但它自主性强,能自我完善、赚钱,也带来安全风险,如隐形越狱植入恶意代码。
员工吐槽“给 AI 擦屁股”更辛苦?揭秘企业 AI 提效的“悖论”与真拐点
InfoQ《极客有约》X AICon 直播探讨企业 AI 提效实战。嘉宾指出用工程化手段控制模型‘幻觉’、做好数据治理很关键。还讨论了模型使用、数据处理、提效感受、招聘标准、场景选择等问题。
刚刚,Ilya官宣出任SSI CEO!送走「叛徒」联创,豪言不缺GPU
Ilya现身X发文,自封SSI唯一CEO,Daniel Levy任总裁,此前跳槽Meta的联创Daniel Gross出局。Ilya拒绝Meta 320亿美元收购要约,称专注事业,有算力和团队,要构建安全超级智能。
2025最大AI赢家的凡尔赛年度总结,哈萨比斯Jeff Dean联手执笔
谷歌由Jeff Dean和哈萨比斯牵头完成2025年AI年度总结与趋势展望报告。报告梳理八大研究方向,展示谷歌在模型能力、产品集成、创造力赋能等多领域进展,强调安全责任与开放合作。
作业帮基础观测能力之一监控体系实践
本文介绍作业帮监控体系实践。其监控体系随云原生成长,支持全集群监控。构建时选 Prometheus 采集、VictoriaMetrics 存储,还从多维度采集指标,用自研代理降成本、治理指标,让系统更贴合研发。
任何错误只犯一次:TencentDB Agent Memory 的团队记忆实践
文章聚焦 TencentDB Agent Memory 的团队记忆实践,从组织协作现状出发,阐述其原理、结构、构建方法,通过多方面测试验证其价值,提炼出设计原则,指出其核心是治理系统,目标是提升协作带宽。
前沿模型被曝年度重大漏洞:加密思维链可被轻松提取,GPT,Claude,Gemini 无一幸免
一篇 116 页论文揭示前沿模型思维链重大安全漏洞,Anthropic、OpenAI、Google 的 API 因架构问题,模型隐藏推理过程可通过两次 API 调用被大规模提取,还会带来多种安全威胁。
Marvis 实测:6 个 AI“牛马”扎根桌面之后
作者实测腾讯 Marvis,它能实现终端调度、多 Agent 协同、跨模态任务链执行等。虽在编码、审美等方面有不足,但定位安全实用,适合普通用户,体现 AI 助手从对话工具向执行系统转变。
OpenAI与Anthropic罕见合作:竞争对手联手测试AI安全
OpenAI和Anthropic完成联合评估,用内部工具测对方模型并公开结果。测试覆盖指令层级、越狱等四大领域,还发现不少细节和道德困境情况。此次合作意义重大,为行业树立安全合作先例。
GPT-5系统提示词突遭泄露,17803 token曝光OpenAI小心思!
一份全新GPT - 5系统提示词在GitHub泄露,有17803 token。此提示词设计精细,覆盖用户对齐、拟人风格、输出质量等。还展示了通用关键要求、安全对齐等方面内容。