「低比特量化」共找到 1172 篇相关文章
自回归因果注意力也能并行解码?上交联合UCSD突破LLM推理瓶颈,模型代码全开源
大语言模型推理速度是应用瓶颈,传统方法各有弊端。上交和UCSD团队提出Jacobi Forcing方案,无需重构架构,将AR模型转为并行解码器,提速显著且质量损失小,核心优势多,技术路线全链路优化,实测表现优。
告别“音画割裂”与“人物崩坏”!AutoMV:首个听懂歌词、卡准节拍的开源全曲级MV生成Agent
现有AI视频生成模型做全曲MV有时长限制、音画割裂和一致性差等问题。AutoMV作为开源多智能体系统,模拟人类影视制作流程,能生成长达数分钟、叙事连贯且音画同步的完整MV。
382人、平均95后,MiniMax百亿估值冲刺IPO!招股书首次披露业绩:研发成本仅为OpenAI的1%、收入猛增8倍
12月21日,通用人工智能公司MiniMax通过港交所上市聆讯。其员工年轻,研发成本仅为OpenAI的1%,收入猛增,产品覆盖多模态。此次聆讯或倒逼行业转向“经营叙事”,加速行业分化。
小米MiMo-V2-Flash开源:3090亿参数大模型能否改写AI行业规则!
2025年12月16日小米开源旗舰大模型MiMo - V2 - Flash,参数3090亿。它有独创‘按需激活’机制,推理成本低。采用MIT协议,价格亲民,构建全栈开源矩阵,在编程、长文本处理等领域表现出色。
五年,终于等来Transformers v5
Transformers v5发布首个RC版本v5.0.0rc0,跨越从v4到v5长达五年的技术周期。其日下载量从2万次激增至超300万次,总安装量突破12亿次。v5将PyTorch确立为唯一核心后端,聚焦四大维度进化。
Gartner发布生成式AI模型提供商魔力象限
Gartner发布《生成式AI模型提供商创新指南》,首次对生成式AI市场进行象限划分,按功能完整性和未来潜力将厂商分为新兴领导者、新兴挑战者、新兴远见者和新兴专家四个区域,还指出AI正从实验转向企业核心层。
6666!NuerIPS满分论文来了
NuerIPS唯一满分论文结论惊人,指出真正决定推理上限的是基座模型本身而非强化学习,且蒸馏比强化学习更有望实现大模型自我进化,这给正火热的RLVR泼了冷水。
Zero-RAG,对冗余知识说“不”
文章指出大语言模型知识冗余,RAG 检索效率低。复旦大学邱锡鹏提出 Zero - RAG,能精准识别并剪除冗余知识,砍 30%语料准确率掉点小,检索延迟降 22%,还介绍了其技术方案。
Kimi K2 Thinking,最强思考模型,附实测
Moonshot AI发布Kimi K2 Thinking模型,它能边思考边行动,是目前最强开源思考模型,多项指标超GPT - 5等闭源巨头。其具独特架构,有性能优势,还给出部署方式,实测表现佳。
一句话搞定后端?揭秘被 52.1k 开发者选择的 PocketBase:真能让你 0 运维快速上线产品吗?
PocketBase是“把后端打包成一个文件”的开源项目,既可以作为独立的轻量后端服务直接运行,也能作为Go库嵌入到应用中。它能解决团队做MVP等遇到的痛点,有诸多核心功能和技术优势。