开源动态8
开源VDN - H3:视频生成比播放还快
AI工程化
AI 摘要
OpenVDN团队:开源基于MiniMax H3的VDN,将视频生成速度提升75 - 90倍,14.4秒视频11.23秒搞定。采用混合注意力机制,平衡质量与速度,代码等全开源。
阅读原文 · AI工程化
视频生成比播放还快:开源VDN-H3,14秒视频11秒搞定
近期,网络出现“无限流”视频,源于MiniMax H3。OpenVDN团队开源Video Delta Net(VDN),基于MiniMax H3使视频生成速度提升75到90倍,14.4秒的768p视频11.23秒就能生成。它采用混合思路,性能提升显著。

关注公众号
扫码关注
第一时间收到每日精选
相关文章
7
小扎:Meta新模型逼平Fable 5还便宜
Meta推出新模型Muse Spark 1.3,在Artificial Analysis榜单中与Fable 5打平手。小扎称其在Coding和Agent工作有大幅提升,还便宜。网友实测它真能肝、真能省,Meta团队核心研究员也透露背后改动。
量子位
8
Hugging Face机器鸭Microduck销售火爆
Hugging Face推出售价399美元的机器鸭Microduck,预售火爆,24小时销售额超260万美元。它开源且可玩性高,社区二创丰富。其配置“五脏俱全”,由中韩中多方合作,软件栈也全套开源,民间复刻成本超原版。
机器之心
新闻资讯8
李飞飞团队发布多模态世界模型 Atlas
李飞飞创办的 World Labs 发布新一代世界模型 Atlas,称其为‘全球首个多模态世界模型’。它从零训练,能同时完成视频生成、3D 重建和时空模拟,已向少数伙伴开放测试,未来将成 Marble 底层模型。
DeepTech深科技
开源动态8
智谱「牛来」模型:国产开源多模态利器
神秘模型「牛来」真身曝光,是智谱刚开源的 GLM - 5.3 Flash,为 5 系列首个原生多模态模型。它尺寸小能力强、价格低,用国产卡,实测多模态和 Coding 能力出色,架构全新,开源后将模型、算力和生态结合。
量子位