视频扩散技术」共找到 3750 篇相关文章

新闻资讯7

刚刚,马斯克「金色擎天柱」首曝!这双真人手刷屏,50万年薪岗危了

Salesforce创始人放出全新Optimus视频,其金色外观、类人手部引关注,网友猜测Optimus 3要来了。马斯克称今年目标产5000台,2026年达5万台。同日,Figure公司的02能自主装碗入洗碗机。

新智元
开源动态8

世界模型有了开源基座Emu3.5!拿下多模态SOTA,性能超越Nano Banana

北京智源人工智能研究院的悟界·Emu3.5是最新最强的开源原生多模态世界模型,能处理图、文、视频任务,在多项权威基准上性能亮眼,还具备理解长时序等能力,背后有技术创新,且选择开源。

量子位
开源动态8

南洋理工、北大、上海AI实验室开源长记忆世界模型

目前世界模型模拟方法在维持长期一致性上有挑战,南洋理工大学、北京大学王选计算机技术研究所、上海人工智能实验室联合开源长记忆世界模型WORLDMEM,介绍了其记忆机制、基础架构、训练技术及检索策略等。

AIGC开放社区
新闻资讯8

来自MIT最强AI实验室:OpenAI天才华人研究员博士毕业了!

OpenAI华人研究科学家陈博远完成MIT博士论文答辩。他不到4年读完博士,辅修哲学,是GPT图像生成核心成员和Sora视频团队成员,将推进世界模型技术,强调视觉世界模型对具身智能至关重要。

新智元
产品应用8

实测全新 SkyReels :AI 创作,终于连成了一体

当前AI生成技术虽强,但视频创作仍门槛高、流程琐碎。昆仑万维推出全新SkyReels,是多模态创作系统,AI科技评论实测其画布、Agent等功能实用,它依托统一框架,核心竞争力在实现“统一性”。

AI科技评论
新闻资讯8

Gemini负责人爆料!多模态统一token表示,视觉至关重要

Gemini模型行为产品负责人Ani Baddepudi与谷歌AI Studio产品负责人探讨Gemini多模态技术,涉及设计理念、应用及发展方向。指出多模态对构建AGI重要,还介绍Gemini 2.5视频理解亮点与‘万物皆视觉’理念。

量子位
算法论文7

BLIP3-o统一图像生成与理解,多模态融合趋势显现

BLIP3 - o致力于统一图像理解和生成、提升生成质量和效率。它融合自回归与扩散模型,采用CLIP + Flow Matching架构等技术亮点。经训练,在图像理解和生成任务表现出色,指令微调效果显著。

CourseAI
产品应用8

国产算力Day 0适配,一人剧组时代到来,商汤Seko 2.0降本增效让AI短剧真正落地

商汤Seko 2.0率先实现创编一体与多剧集智能生成,通过一致性控制技术与国产算力适配,缩短漫剧制作周期。它解决了AI视频生成痛点,降低成本、提升效率,适配国产芯片,还拓展了内容生态。

AIGC开放社区
产品应用7

一个国产AI视频产品如何吸引全球6000万用户?|甲子光年

文章围绕爱诗科技旗下AI视频产品PixVerse展开,讲述其吸引全球6000万用户的历程。介绍创始人王长虎两次技术路线转型,先做To C再推API,还谈及B端业务场景及‘拍我AI’国内上线等情况。

甲子光年
产品应用8

全新SkyReels发布,昆仑万维要通吃创意生态 | 甲子光年

11月4日,昆仑万维发布全新SkyReels,定位“一站式、零门槛多模态AI创意平台”。它有无限画布、智能副驾、AI视频模板三大革新,重构创作流程。其技术进化快,还加入平面设计功能,有望撬动更大应用市场。

甲子光年