算法论文8
上交&上海AI Lab:dLLMs存在致命安全缺陷
深度学习自然语言处理
AI 摘要
上交与上海AI Lab等团队研究发现,扩散语言模型存在致命安全缺陷。其提出的DIJA攻击框架可让多个dLLMs输出有害内容,呼吁从掩码拒绝机制、对齐训练等方面加强安全。
阅读原文 · 深度学习自然语言处理
“掩码即武器”,四款扩散LLM全部破防 ? 上交&上海AI Lab发现dllm致命安全缺陷
上海交通大学、上海人工智能实验室等团队研究指出,扩散语言模型(dLLMs)有根本性架构安全缺陷。他们提出DIJA攻击框架,能让多个dLLMs大概率生成有害内容,还呼吁从多方面加强dLLM安全。

关注公众号
扫码关注
第一时间收到每日精选
相关文章
算法论文8
人大蚂蚁团队发布LLaDA MoE v2及扩展定律
中国人民大学高瓴人工智能学院与蚂蚁集团合作,首次系统刻画混合专家扩散语言模型扩展定律,据此训练LLaDA MoE v2,实现扩展效率与智能双重突破,将推动其迈向规模化时代。
机器之心
算法论文8
何恺明团队新作ELF,连续扩散效果佳
何恺明团队提出ELF模型,将扩散过程置于连续向量空间,只在最后翻译成词。它用一个网络实现去噪和解码,引入自条件机制。实验显示,ELF用不到其他方法十分之一数据,生成质量全面领先。
机器之心
算法论文8
何恺明首个语言模型ELF不走GPT老路
何恺明团队推出全新连续扩散语言模型ELF,不走GPT自回归老路。它将生成过程留在连续embedding空间,最后离散化变回token。ELF用较少参数、训练token和采样步数,跑赢主流扩散语言模型。
量子位
算法论文8
扩散模型做智能体:速度与能力难两全
南洋理工大学陶大程教授团队联合发布评测报告,揭示扩散语言模型在智能体能力上有系统性缺陷,落后自回归模型。还分析其失败原因,提出评测框架,明确能力边界并给出研究建议。
机器之心