「7B模型」共找到 8081 篇相关文章
开源中小模型+Skills也性能暴增!卢森堡大学探索了小模型驾驭Skills的边界
卢森堡大学等研究探索小模型驾驭Skills的边界。工业界因数据安全渴望开源小模型,智能体Skills框架让小模型性能暴增。研究拆解小模型处理复杂任务的方法,还验证不同策略有效性,发现代码专用模型优势。
Agentic Coding表现创新高,全新KAT系列模型强势霸榜SWE-Bench
快手 Kwaipilot 团队推出 KAT 系列两款 Agentic Coding 大模型,KAT - Dev - 32B 开源,KAT - Coder 闭源。两模型在 SWE - Bench Verified 表现出色,且在多训练阶段创新优化,有强大代码生成能力和涌现现象。
开源多模态推理「破壁」时刻:MMFineReason助力4B逆袭30B
长期以来,开源多模态模型在复杂推理任务上与顶尖闭源模型有差距,核心痛点是高质量推理数据匮乏。上海AI实验室OpenDataLab团队开源MMFineReason框架及大规模数据集,小模型凭此实现性能逆袭。
语音界Sora!微软刚开源新模型,一次生成90分钟语音、3200倍压缩率
今天凌晨微软研究院开源创新音频模型VibeVoice - 1.5B,有诸多技术突破,如可合成90分钟语音、支持4名发言人、3200倍音频压缩等,还首创双tokenizer协同架构。未来微软还会开源更大参数模型。
Rex-Omni:用 3B 模型颠覆目标检测
长期目标检测依赖传统坐标回归模型,MLLMs方法存在不足。IDEA研究院提出30亿参数的Rex - Omni多模态大模型,在零样本测试中表现超现有回归模型,还具备丰富语言理解能力,有独特设计和训练流程。
智谱开启狂飙模式!7倍提速,全球最快,旗舰模型即问即答
5月22日,智谱上线GLM - 5.1高速版API,输出速度达400 tokens/s,刷新全球大模型API速度纪录,比原版提速约7倍。该速度由GLM团队和TileRT团队联合打造,核心优化分三层推进,且是稳定可用的生产级能力。
Meta重返开源!30B本地Agent塞进24GB显存,LeCun火速力挺
Meta重返开源,推出开源模型Muse Glimmer,参数30B,经量化后一块24GB消费级显卡就能跑通,拥有完整Agent能力。Meta还预告Muse Spark 1.2开放权重版本将发布,扎克伯格称会恢复发布部分开放模型。
大神李沐回归B站「做了个实时数字人」,直言「水平吊打我自己」
大神李沐回归B站,展示用创业公司BosonAI的Higgs Avatar v1模型做的实时数字人,称其水平“吊打自己”。该模型能带来接近真人的临场感,操作简单,有四大核心优势,已进入内测。
国产免费2B开源语音模型征服《莽撞人》!复刻郭德纲最难贯口
国产免费2B开源语音模型VoxCPM 2,联合OpenBMB开源社区等推出。它能复刻郭德纲《莽撞人》贯口,覆盖九种方言、三十门外语,音质达48000Hz。还可在线体验,有降噪等功能,技术独特且开源工具链完备。
“AI大神”李沐终于开源新模型,爆肝6个月,上线迅速斩获3.6k stars!
7月23日,“AI大神”李沐开源音频基础模型Higgs Audio v2,构建于Llama - 3.2 - 3B之上,预训练数据丰富。该模型在多个测评中成绩领先,有多种能力,李沐介绍其技术及训练方法。