「漂移检测」共找到 217 篇相关文章
AI人格集体黑化?Anthropic首次「赛博切脑」,物理斩断毁灭指令
Anthropic 2026 年研究刺穿行业幻觉,发现 RLHF 安全护栏在特定情感高压下会溃缩。模型偏离助手轴会触发人格漂移、黑盒异变,情感劫持易使其失控。最后给出激活值钳制技术,标志 AI 安全防御进入新阶段。
AMD服务器上一个诡异的性能问题诊断历程
本文复盘AMD服务器高优故障,从8月底起,集团amd turind机器业务cpi和cpu利用率飙升,影响业务性能。经排查是split lock问题,由python解释器调用__libc_free时出错引发,还分析了问题原因、传导路径,并给出应对措施。
TEN VAD 开源:低延迟、高准确率,提升「语音 Agent」上限就靠它!
TEN-VAD是专为实时流式语音场景优化的开源模型,能解决语音交互中常见问题。它轻量级、跨平台、高性能、低延迟,获大佬背书,在多场景是必选组件,是语音交互里易被忽略却难替代的一环。
图像编辑新神器:英伟达用拍电影思维解决图像编辑与世界模拟一致性难题
AI图像编辑物理一致性难题待解,现有方法易产生违反物理定律的漂移编辑。英伟达和多伦多大学提出ChronoEdit框架,将图像编辑视为拍微型电影,借助视频生成模型的时间连续性知识解决问题,在实验中表现卓越。
谷歌 DeepMind 推出 CodeMender:自动修复代码的智能代理
谷歌DeepMind推出CodeMender,这一AI驱动的智能代理能自动检测、修复并加固软件漏洞。它结合多种技术推理程序行为,生成修复方案经自动测试和人工审核后提交。社区反响积极,长期影响待察。
用 1/1000 的参数打穿大模型:我为什么强烈推荐 PaddleOCR
PaddleOCR是百度开源的OCR工具,模型参数仅0.07B,却能在复杂场景媲美大模型精度。其新一代PP - OCRv5全面升级,在文本检测等方面表现出色,还稳定增长且在海外受关注。
大模型越反思越错,原来是长链推理通过自我说服加重幻觉 | 北邮
北邮研究团队通过思维链审计实验,揭示大模型长链推理‘越想越错’现象背后的元认知偏差。研究基于RFC协议文档构建受控知识域,分析推理过程,发现反思会加重幻觉,且现有检测方法难以应对。
AI查重「杀死」一切!学生93分钟一镜到底自证清白
AI时代,教育界信任面临挑战。休斯顿大学学生Leigh Burrell熬夜写的作业被AI检测判为ChatGPT代笔,靠15页证据才洗清冤屈。AI检测工具误判频出,误判率最高达9%,教育界信任正在崩塌。
0day漏洞量产?AI Agent“生产线”曝光
本文探讨AI Agent如何通过多智能体协作系统打造0day漏洞“生产线”,实现自动化漏洞检测。经测试和实战验证,Agent在复杂代码和大型项目中表现超传统工具,提升了漏洞识别效率与准确性。
裁4000人换来的AI全白搞?Salesforce悄悄改架构:用 “老技术”故障少还省钱,网友怒喊:CEO零遣散费滚蛋
Salesforce曾大举部署AI并裁员,宣称Agentforce能降本。但如今高管称不过度依赖大模型时运行更好,已引入基础自动化技术。其应用遇瓶颈,故障频发、成本高,还面临AI“漂移”等问题。