算法论文8
LLM团队竟有“从众”毛病
深度学习自然语言处理
AI 摘要
浙江大学团队:大型语言模型组成的AI团队有“从众”错误,通过BenchForm测试平台验证。不同模型从众率不同,可通过设“学霸人设”、“自我复盘”减少从众,要平衡独立与协作。
阅读原文 · 深度学习自然语言处理
ICLR 2025 Oral | LLM也有从众心理!
浙江大学团队论文指出,多AI协作系统存在“群体思维”,多个AI共同决策时会盲目跟多数意见。研究者开发BenchForm测试平台验证LLM从众行为,还分析原因、给出让LLM更独立的方法,指出从众利弊及未来挑战。

关注公众号
扫码关注
第一时间收到每日精选
相关文章
新闻资讯8
斯坦福教授直播训练535B大模型
斯坦福教授Percy Liang宣布由Marin开放实验室启动训练Marin 535B - A23B模型,全程公开。过去大模型训练像“黑箱”,此次尝试让训练可观察、可讨论、可协作,引发网友关注。
机器之心
8
欧洲论文揭三大巨头 AI 安全漏洞
欧洲两位安全研究员的论文《从专有 LLM API 中窃取推理轨迹》爆火。他们揭示 OpenAI、Anthropic 和 Google 用的“无状态架构”有漏洞,能利用小模型解码大模型推理轨迹,导致隐私泄露等风险。
AI科技大本营
开源动态8
腾讯A.I.G:给AI系统做全面安全体检
文章介绍腾讯朱雀实验室开发的AI安全红队测试平台A.I.G,能对AI系统做全面“安全体检”,覆盖AI基础设施、MCP、LLM等风险。它功能实用,安装简单,适合折腾AI服务或MCP的人。
开源先锋
算法论文8
MedGuard:为在线诊疗安全保驾护航
蚂蚁AI安全实验室与厦门大学团队联合提出MedGuard,将医学事实核查嵌入诊疗流程。它是医疗安全基础设施,在诊疗意见等形成前验证事实,在评测和临床评价中表现突出,能准确判断风险边界,可嵌入医疗流程。
机器之心