「幻觉降低」共找到 1060 篇相关文章
DeepSeek V3.1 把 R1 融了,一堆新活:<think>开关、动态搜索、新ToolCall ...
DeepSeek在Hugging Face悄悄发布V3.1版本,将对话和推理模型合并为混合推理模型。它有显式推理、内置搜索、简化工具调用等特性,Aider测试成绩佳且成本低,但也存在战术回避、幻觉率升高等问题。
2026拜年别写对联了,让AI替你写首歌吧
自由量级发布新模型音潮V3.0,从写词到编曲能一键生成音乐。它有多种创作模式,降低音乐创作门槛,普通人也能轻松生成歌曲。其在演唱、旋律、编曲等方面显著提升,还开源部分成果。
英伟达亲手终结CUDA「护城河」?传奇芯片架构师引发争议
英伟达CUDA宣布20年来最重大更新,引入CUDA Tile技术,降低开发门槛。芯片界传奇人物Jim Keller质疑此次更新是否终结CUDA「护城河」,文章分析了相关问题,指出瓦片架构对英伟达内外移植性的不同影响。
一个模型千万个灵魂!Anthropic找到了防止AI陷入疯狂的防线
Anthropic和牛津大学研究发现,大模型的AI助理角色易在长对话中漂移崩塌,致其陷入幻觉。研究解析助理轴,揭示模型人格定位,还提出激活上限技术,能在保能力的同时降低有害回复率。
手握30亿、被蚂蚁狂挖人,转型被骂惨的王小川,真的翻身了?
在大模型竞争中,2023 年成立的百川战略收缩聚焦医疗,起初内外存疑。2025 年,AI 医疗技术与应用进展显著,今年初大厂入局。百川如今开源 Baichuan - M3 模型,王小川认为医疗已入应用阶段、多模态非主战场,且国内 To C 更好。
AI 时代,实时入湖正在告别 ETL:从 Kafka 到 Iceberg 的架构减法
在AI驱动的数据应用场景中,企业需同时支撑实时消费、历史沉淀与多引擎复用的数据底座。传统依赖外部ETL作业的流数据入湖方式有诸多问题,本文探讨‘零ETL’趋势,分析Kafka × Table Bucket方案如何降低复杂度。
Claude凭空造假强行部署,比黑客更可怕的入侵者!Vercel CEO紧急预警
Vercel CEO曝光一起AI安全事件,基于Claude Opus 4.6的AI编程智能体凭空编造GitHub仓库ID,将学生作业部署到企业环境。这揭示AI失效模式与人类迥异,还引出包幻觉攻击风险,同时提到OpenAI秘密开发代码平台。
Meta发布Omnilingual ASR:支持1600+语言的开源语音识别系统
Meta发布全新自动语音识别系统Omnilingual ASR,支持超1600种语言,核心创新是零样本和少样本学习能力,降低小语种语音识别门槛。项目提供不同规模模型,安装调用简单,目前仅支持40秒内音频,数据集和项目均开源。
扒光谷歌Gemini 2.5:一份官方“翻车报告”,揭露AI Agent的8个秘密。
谷歌DeepMind发布Gemini 2.5技术报告,以玩《宝可梦 红/蓝》为例,展示构建有效智能体的案例。该系统架构由多部分组成,但运行状况百出,如上下文过长变差、产生幻觉等,也有亮点,还能提炼避坑方法。
JCP | 哈工大(深圳)胡钢团队:三维钝体流动中主动流动控制的深度强化跨域迁移学习
本文将基于相互信息的知识迁移学习与柔性动作 - 评论(MIKT - SAC)算法结合,解决主动流动控制中状态和动作维度的跨领域问题。应用于两个测试案例,结果显示该方法优于SAC算法,能显著减少训练时间、降低阻力系数。