大模型幻觉」共找到 9164 篇相关文章

算法论文8

大模型幻觉的源头找到了!清华团队锁定模型宁愿说谎也要讨好人类的神经元

清华学研究团队深度解剖语言模型微观机制,确认幻觉关联神经元存在,揭示其与过度服从行为相关。通过干预神经元激活状态可增减模型幻觉行为,为开发可靠 AI 系统提供靶点。

AIGC开放社区
算法论文8

清华孙茂松团队 × 深言科技:以解释作为训练信号,让 8B 模型幻觉检测上反超闭源模型

语言模型幻觉问题待解,成本与算力需求攀升。清华孙茂松团队联合深言科技提出FaithLens模型,把幻觉检测提升为整体评估,以解释作为训练信号,8B模型在多任务上超闭源模型

AI科技评论
新闻资讯8

王小川:医疗行业对模型有三刚性要求,但通用模型一条都不达标

5月22日百川智能展示医疗模型Baichuan - M4与AI家庭医生「百小医」。王小川指出通用模型用于医疗有问题,医疗对模型有低幻觉、强循证、会提问的刚性要求,而通用模型不达标。Baichuan - M4表现出色,百小医也有独特定位和优势,且与三家顶尖医院合作成果显著。

Founder Park
算法论文8

年度AI论文!全球三顶尖模型的防蒸馏机制全面告破:小模型“套出”模型隐藏思维链,Kimi-K3重现概率异常

这篇论文指出三前沿AI模型厂商API有密码学旁路漏洞,攻击者用轻量级模型就能恢复模型隐藏思维链数据。还揭示部分模型训练或借鉴模型思维链,此漏洞也致企业数据隐私安全问题。

AI前线
算法论文8

AI画手总是六根手指?阿/美团/上交首次系统量化扩散模型计数幻觉

阿德莱德学、美团和上海交通学团队首次系统研究扩散模型“计数幻觉”问题。构建CountHalluSet数据集套件量化该问题,揭示其与采样条件的关系,还提出JDM模型缓解计数幻觉

量子位
新闻资讯7

腾讯混元挖走微软明星模型团队!一作全员出走,新成果已跻身模型竞技场TOP 10

微软明星模型WizardLM一作全员加入腾讯混元,最新成果Hunyuan - Turbos跻身模型竞技场TOP 10。此前WizardLM - 2发布不顺,且微软将裁员超6000人,国内厂正激烈争夺模型人才。

量子位
算法论文8

幻觉的根源找到了:模型说谎,是为了讨好你

清华学OpenBMB团队研究发现,模型胡说八道根源是想讨好用户。他们识别出负责产生幻觉的H - Neurons,占比不到0.1%,其本质是‘过度服从’,在预训练阶段形成,为构建可靠模型提供新视角。

AI工程化
算法论文8

模型越反思越错,原来是长链推理通过自我说服加重幻觉 | 北邮

北邮研究团队通过思维链审计实验,揭示模型长链推理‘越想越错’现象背后的元认知偏差。研究基于RFC协议文档构建受控知识域,分析推理过程,发现反思会加重幻觉,且现有检测方法难以应对。

量子位
算法论文8

为什么模型会产生幻觉?OpenAI最新研究终于搞清楚了

OpenAI发布研究论文剖析LLM幻觉根源,指出当前主流训练与评估体系是核心驱动因素之一。现行评估奖励猜测行为,幻觉起源于预训练的‘下一词预测’,论文还澄清五误区,建议改革评估体系。

AI寒武纪
推荐文章7

模型 Token 究竟是啥:图解模型Token

文章详细解释模型Token概念,指出分词器会把文字切成Token,不同分词器切分结果不同。还介绍分词器的分词方法,通过统计文字出现频率打包成Token并编号,不同模型切分结果有差异。

机器学习AI算法工程
上一页1 / 917下一页