大模型压缩」共找到 9204 篇相关文章

算法论文8

推理效率狂飙60倍:DiDi-Instruct让扩散模型16步超越千步GPT

普渡学等研究者提出 DiDi-Instruct 后训练方法,可将扩散语言模型推理加速 60 倍,超越传统 GPT 模型。该方法实现推理效率与效果双提升,为语言模型落地提供新方案。

机器之心
推荐文章7

数据到好猜想:如何用模型做市场研究?

文章指出模型重塑用户需求调研,并非按常规用AI获取和清洗数据,而是让模型扮演真实用户。以品牌分析社交媒体数据为例,探讨数据局限,还介绍‘好猜想’标准,最后说明Atypica.AI能构建消费者智能体解决归纳问题。

Founder Park
推荐文章8

别再迷信模型!吴恩达亲授AI秘籍:小模型+边缘计算=财富密码

吴恩达指出,AI创业真机遇不在模型,而在智能体。智能体市场潜力,创业者可发挥其专业化优势。还建议忽略AGI,用AI解决日常问题,关注小模型边缘计算、军民两用场景,构建可信AI应用。

新智元
推荐文章7

模型是不是到顶了?瓶颈到底在哪

文章探讨模型是否到顶,指出‘到顶’争论分三个问题,靠堆模型提升能力之路变平,受数据和成本约束。但模型还有后训练和推理时计算两个发展方向,未来进步或来自更会用算力。

AI Reading Hub
产品应用7

卡帕西模型横评方法太好玩了!四AI匿名参赛评分,最强出乎意料

卡帕西发布“模型议会”web app,系统通过OpenRouter调起多模型开会商议,各模型答题、互评、排序,由主席模型给出统一答案。可对比模型差异,模型自评与人类主观或不同,多模型集成或成突破点。

量子位
新闻资讯7

《AI模型与异构算力融合技术白皮书》10月10日发布

算泥社区《AI模型与异构算力融合技术白皮书》10月10日14:00线上发布。AI模型爆发使算力需求激增,异构算力成刚需。国内外政策与产业驱动其发展,该白皮书能为开发者提供实用技术参考。

AIGC开放社区
开源动态8

从多模态模型中「拆」出音频向量模型

Google 发布原生多模态向量模型 Gemini Embedding 2,推动 Omni Embedding 发展。Jina AI 团队分享从多模态模型中「拆」出音频向量模型的经验,介绍架构、训练数据,对比四种做法,还提及评测、应用场景及结论。

Jina AI
新闻资讯7

250份文档“毒晕”模型!无论规模小统统中招

Claude母公司Anthropic联合两机构研究发现,仅250份恶意文档就能在不同规模模型植入“后门”漏洞,打破以往对模型数据中毒的认知,给厂商防御敲响警钟。

量子位
开源动态8

里程碑!逻辑智能发布全球首个完全开源语音模型框架LLaSO,语音AI迎来新纪元

逻辑智能发布全球首个完全开源语音模型框架LLaSO,它像“全家桶”,提供高质量数据、统一评测基准和强基础模型。语音模型发展遇瓶颈,LLaSO框架及参考模型LLaSO - Base有望打破僵局。

AI科技评论
算法论文8

挑战 1 比特!ETH Zürich 秦浩桐:如何把模型「塞进」小设备?| IJCAI 2026

IJCAI 2026会上,秦浩桐给出创新解法,挑战无需重训的“后训练量化”极限,将庞的LLM强行压缩至极端的1比特与2比特。其团队的BiLLM与SqueezeLLM打破了后训练量化魔咒,还指出极低比特量化的三挑战。

AI科技评论