「压缩方法」共找到 1717 篇相关文章
推翻「预测下一个token」范式!微信AI新研究:把token压缩成连续向量更具性价比
微信AI和清华团队提出新范式CALM,把token打包成连续向量,让大模型从预测下一个token转变为预测下一个向量。实验表明它能减少生成步骤,在平衡性能和计算成本时性价比更高。
别再乱学AI了!我花7天实践了张Zara的方法,从此告别焦虑
作者实践张Zara的AI学习法后告别焦虑,分享学习-实践-链接-输出的心法。包括高质量输入,如看长视频、跟随创造者、深度用产品;内化输出,如公开学习、与创造者交流、实践;还提及启动和持续输出要点及优质信息源。
AI写CUDA算子准确率92%,到国产芯片只剩4%?上交方法直线拉升,DeepSeek也适用
GPT-5.2写CUDA算子正确率92%,给华为Ascend NPU写算子仅4%,因公开数据少等致‘新硬件冷启动’难。上海交大团队EvoKernel不训新模型、不标新数据,将GPT-5.2正确率从4%拉到83%,还拓展到DeepSeek架构算子。
腾讯发布SpecExit算法,无损压缩端到端加速2.5倍!解决大模型长思考效率难题
腾讯发布 SpecExit 算法,将思考早停与投机采样融合,利用轻量级草稿模型预测“退出信号”,在不引入额外探测开销的前提下,实现动态、可靠的思考早停,在 vLLM 上推理端到端加速 2.5 倍,准确性和推理效率得到双重保障。
微软 CEO 纳德拉:离了 AI 软件开发没法想!编程如诗都是“压缩”。社区:必须拥抱变化。
微软CEO纳德拉在访谈中表示,如今软件开发离不开AI,AI编程已成标配。他强调AI本质是赋能人类的工具,还提及AI普及挑战,同时保持对AI局限性的清醒认知,分享领导哲学与诗意展望。
告别VAE压缩损耗,南京大学用DiP让扩散模型回归像素空间,实现10倍加速与SOTA级画质
南京大学、腾讯优图实验室和新加坡国立大学发布DiP框架,即将开源。该框架不依赖VAE,仅增0.3%参数量,推理提效10倍,在ImageNet获1.79的FID分数,解决扩散模型在像素空间难兼顾质效的问题。
对话原力灵机周而进:模型2.4B就够用,关键是“具身原生”;能闭环才是最高效方法
原力灵机推出首个具身原生模型产品DM0,仅2.4B参数,却能支撑实时处理画面与真机进化。其合伙人周而进称要走具身原生路线,还介绍了数据采集、模型训练等多方面内容及公司发展规划。
一个让 AI 智能体(AI Agent)工作更出色的绝妙方法,简单到令人惊讶:只要给它们设定一个人格
论文揭示无需复杂重新训练就能引导AI行为,提出MBTI-in-Thoughts框架,在提示词里让大语言模型扮演特定MBTI人格,其行为会改变,还经测试验证,有广泛应用前景。
1.9K Star 谷歌开源MCP Toolbox,支持langchain、llamaindex、各类数据库
谷歌开源MCP Toolbox获1.9K Star,支持langchain、llamaindex和各类数据库。它位于应用编排框架间,能简化数据库配置等,可用自然语言交互,还给出python调用方法。
CVPR2025 | 多模态LLM评测Tutorial
多模态大语言模型(MLLMs)研究热门,有效评估成关注焦点。CVPR2025将举办多模态LLM评测Tutorial,梳理评估基准,探讨评估方法,聚焦‘幻觉现象’,团队经验丰富,覆盖多板块内容。