开源动态8
VITA - Audio:53ms语音生成新秀
开源星探
AI 摘要
VITA团队:开源端到端语音模型VITA - Audio,7B参数模型首次生成音频仅53ms,比同级别快3 - 5倍,有超低延迟等优势,代码、数据、权重全公开,助力开发者。
阅读原文 · 开源星探
超低延迟的端到端语音模型!首次生成音频仅需53ms,比同级别模型快3-5倍!
随着语音应用场景普及,语音大模型响应慢成瓶颈。VITA团队开源端到端语音模型VITA - Audio,7B参数模型首次生成音频仅53毫秒,比同级别快3 - 5倍,完全开源,有超低延迟等优势。

关注公众号
扫码关注
第一时间收到每日精选
相关文章
开源动态8
Meta 开源本地运行智能体模型 Muse Glimmer
Meta AI Research 推出 300 亿参数的开放权重模型 Muse Glimmer,采用 Apache 2.0 许可证。它专为本地工作流设计,能在消费级硬件运行,经多项优化,在基准评估中表现出色,还支持多种框架。
AI前线
开源动态8
DSH - better - sidebar 让 DeepSeek Harness 操作更便捷
DeepSeek Harness 是 AI Agent 运行框架,自由度高但默认 Web UI 操作不便。社区插件 DSH - better - sidebar 迅速出圈,装了侧边工作台,整合多样工具,更新勤,适合折腾 DSH 的人。
开源星探
开源动态8
Genspark开源免费AI办公套件GenOffice
Genspark团队开源AI办公套件GenOffice,全平台免费无广告。它界面类似微软Office,零成本上手,AI能直接编辑文档。虽处Alpha阶段,但可切换多种模型,还给出了配置第三方模型的方法。
CourseAI
开源动态8
Noiz AI发布可交互音视频世界模型
过去两年视频生成模型不断提升画面参数,但传统模型生成的视频固定,用户无法干预。而世界模型可跟随操作实时渲染、动态生成世界。目前Noiz AI联合多机构发布实时可交互音视频世界模型HelixWorld 1.0,后续还将开源。
量子位