「幻觉降低」共找到 1060 篇相关文章
砍掉70%内存!陈丹琦团队破解LLM长文本瓶颈
大型语言模型处理长文本时,KV缓存占用内存巨大。陈丹琦团队提出KV足迹作评估标尺,推出分块驱逐与PruLong训练技术,在128K长文本任务中最高降低70%内存,性能损失仅10%。
The Batch:829 | DeepSeek 是怎么做到的
DeepSeek 去年末以低成本训练出先进开源大模型引关注,近日团队披露构建 DeepSeek - R1 和 DeepSeek - V3 的软硬件方案,降低内存和计算需求,其细节公布让更多团队有机会参与前沿研发。
什么是芯片可测性设计(DFT)技术?
在芯片复杂度增加、测试难度增大的背景下,DFT技术应运而生。它是在芯片设计阶段引入测试逻辑的方法,分功能和制造测试,有扫描链、MBIST、边界扫描等核心技术,能提高测试效率、降低成本、缩短开发周期。
成本暴降88%!通义实验室、北大发布ZeroSearch,无需搜索即可激活LLM检索能力
信息检索能力对提升大语言模型推理表现至关重要,但现有方法在训练中面临文档质量不可控和搜索 API 成本高昂两大挑战。为此,通义实验室和北大提出 ZeroSearch 框架,无需真实搜索即可激活 LLM 检索能力,显著降低成本。
独家|清华团队组团创业,押注机器人端侧自进化,已完成首轮融资
过去一个多月,机器人学习风向生变。清华李健雄团队围绕机器人学习等研究多年后成立本溯智能创业。他们认为当下主流技术路线有问题,押注In - Context Learning,让机器人端侧自进化,降低部署成本。
Codex 负责人:「所有人都是 builder」是个很糟糕的主意
OpenAI Codex 团队负责人 Andrew Ambrosino 认为,AI 时代产品开发各环节发生变化,实现成本降低,品味变得更重要。他还谈到岗位角色融合但 PM 不会消失,以及 Codex 发布时机和工作模式等问题。
中国AI算力,开启「共同富裕」之路!
中国AI产业存在算力差距,头部大厂算力过剩,中小企业却受困。中科曙光scaleX40超节点发布,降低高端算力获取门槛,重塑AI创新主体、产业落地路径及国产算力发展方向,推动算力平权。
只要1分钟!电脑装满血龙虾,现在跟下载APP似的
智谱推出电脑端应用AutoClaw(澳龙),从安装到使用仅需1分钟,无需配置。它可切换多种模型,预置50多个Skills。能一键接入飞书,玩法多样,还降低了OpenClaw使用门槛。
OpenAI连夜爆出GPT-5.4! 紧急上新GPT-5.3反击谷歌, AI爹味治好了
谷歌DeepMind推出Gemini 3.1 Flash - Lite不到2小时,OpenAI上线GPT - 5.3 Instant,不卷跑分,专治「聊天翻车」,幻觉率降27%,写作能力提升,还剧透GPT - 5.4更快到来。
火上浇油!Grok在悉尼光明节枪击案上大规模造谣
马斯克的Grok在悉尼光明节枪击案中大规模「翻车」,将救人英雄误认、混淆枪击与气旋等,暴露生成式AI处理实时信息的「幻觉」缺陷,凸显其无价值观、难辨虚实的软肋。