「大模型蒸馏」共找到 9268 篇相关文章
Zero-RAG,对冗余知识说“不”
文章指出大语言模型知识冗余,RAG 检索效率低。复旦大学邱锡鹏提出 Zero - RAG,能精准识别并剪除冗余知识,砍 30%语料准确率掉点小,检索延迟降 22%,还介绍了其技术方案。
想清楚再动手:具身智能也要学会脑补未来和择优执行 | RSS 2025
近年来基础模型在具身智能领域能力惊人,但在真实部署中常‘用不好’。卡耐基梅隆大学与伯克利人工智能研究院团队提出 FOREWARN 框架,结合‘世界模型’与‘多模态语言推理’,解决部署智能难题。
The Batch: 867 | 印度推动本土人工智能建设
印度在资金有限、语言与方言众多情况下,正加倍努力建设本土大模型。政府资助初创企业、调配算力,多家公司研发多语言模型,虽面临挑战,但旨在开发符合自身需求的人工智能。
实测Qwen3.8-Omni-Flash:全模态Agent有了“白菜价”
本文是对千问最新推出的Qwen3.8-Omni-Flash全模态模型的实测,该模型大幅降低全模态Agent使用成本,API价格远低于竞品,开放1M上下文免费测试额度。
告别黑箱解释!首个潜变量自动解释框架 | CIKM'25
深度生成模型内部运作如「黑箱」,潜变量意义难捉摸。埃默里大学团队提出LatentExplainer框架,经数据扰动、智能提示、不确定性评估三步,为潜变量生成易懂解释,提升模型解释质量与可靠性。
Cursor定价又更新,直接变成" 买API ",Coding 产品包月模式走不下去了
Cursor一年三变价,9月15号后个人版按模型推理用量计费,有Pro、Pro Plus、Ultra方案,还对大学生免费计划二次验证。因模型成本涨、竞争大,包月模式难以为继,多家编程工具都调整定价。
紫东太初推出GMC核心集剪枝方法,少80%Token仍满血保真多模态能力
视觉Token冗余是多模态模型高效推理与落地的瓶颈,传统筛选方法有缺陷。紫东太初团队提出GMC核心集剪枝方法,具双阶段架构,优势多,实验显示其能在减少Token同时保持性能。
自媒体误读了 DeepSeek-OCR:一图胜千言
近期,DeepSeek-OCR引发关注,但很多媒体误读其为OCR工具,实际是视觉语言模型。它是为大文档等场景优化的视觉压缩与识别系统,架构新颖,训练讲究,效果出色,为行业带来新思路。
关于中美 AI 竞争的差距,我可能真的说错了
作者因读者反馈,意识到自己对中美AI竞争差距理解不全面。基模能力中国整体落后美国,但部分领域领先。模型能力提升难被多数用户感知,且中美在商业模式、模型开源等方面差异大。
CVPR 2026 | 让AI视频不再「串戏」:免训练精准控制多段动作,SwitchCraft一招破解逻辑崩坏
随着文本到视频扩散模型发展,AI视频生成有进展,但开源模型处理多事件提示词时存在技术瓶颈。西湖大学团队提出免训练框架SwitchCraft,引入注意力控制机制,入选CVPR 2026,代码已开源。