「自蒸馏微调」共找到 1410 篇相关文章
支持30种语言,多种中文方言 [四川话、粤语等]的颠覆性无分词器TTS系统
VoxCPM是无离散音频分词器的语音合成系统。VoxCPM2基于MiniCPM - 4构建,有20亿参数,支持30种语言和9种中文方言,具备音色设计、可控声音克隆等特性,还完全开源,商用就绪。
刚刚,智谱和华为搞波大的:中国首个国产芯片训练出的SOTA多模态模型!
智谱与华为合作开源新一代图像生成模型GLM-Image,是中国首个全程用国产芯片训练的SOTA多模态模型,擅长文字渲染,拿下多项榜单第一,API调用一张图只要0.1元,还解析了其技术架构。
商业航天开始交卷
今年工信部批复卫星物联网商用试验许可,商业航天迈进商业化。时空道宇作为获批民企成观察样本,它解决卫星量产等难题,实现车载前装量产,构建全栈闭环能力,为行业提供思路。
人类造工具200万年,工具开始研究工具!97年天才少年带队,把“AI寻找研究方向”做成了现实
2026年AI开始研究AI(AI4AI),深圳EvoMap团队用蜂群协作做出产品EvoX。他们创新Agent组织方式,有实验数据支撑其效果,还开源成果AutoResearch解决AI痛点,在生活场景优化旧算法可行。
大型挂机现场:马斯克的55万英伟达GPU,利用率才11%
《The Information》报道,马斯克旗下xAI有55万英伟达GPU,利用率仅11%。原因包括大规模部署协调难、数据传输瓶颈和训练间歇性。这是行业普遍问题,xAI着手解决,设定50%利用率目标。
Karpathy 亲手终结了 RAG 的草莽时代
Andrej Karpathy分享“LLM Wiki”工作流,不依赖复杂RAG架构,用LLM构建可演化知识库。该方法引发关注,有人认为它“杀死了”RAG,技术社区和企业反响热烈,预示新的产品方向。
AI 本地跑?Google 新开源模型上线,本地量化后占用不到 200MB 内存,支持百余语言
Google DeepMind推出开源嵌入模型EmbeddingGemma,专为本地设备高效运行设计。它用Matryoshka方法和量化感知训练,提升效率。在MTEB测试中成绩佳,支持百余种语言,内存占用少,已集成多种工具。
Jina Code Embeddings: 为高质量代码搜索而生的0.5B/1.5B向量模型
本文介绍了 Jina AI 开源的代码向量模型 `jina-code-embeddings`,含 0.5B 和 1.5B 规模,有 GGUF 量化版本。它性能顶尖,支持多任务与 15 种语言,还介绍了训练方案、使用方法等。
Agentic Deep Research新范式,推理能力再突破,可信度增加,蚂蚁安全团队出品
尽管LLM能力提升,但在复杂任务上受静态内部知识限制。业界提出Agentic Deep Research系统,不过现存系统有梯度冲突和奖励稀疏问题。蚂蚁安全团队提出Atom - Searcher,解决上述问题,实验效果良好。
一键搞定双语播客的项目,效率+200%,太6了!
文章介绍开源项目Twocast,它是AI播客生成器,能模拟双人自然对话,3分钟产出一期播客。有双人对话、多输入、多语言等特色,提供两种安装方式,适合多类人群。