素材生视频」共找到 1076 篇相关文章

算法论文8

从「片段成」到「长视频漫游」:OmniRoam探索轨迹可控的长视频成新范式

成式视频发展中,长时序视频成面临挑战。研究者提出 OmniRoam 新方法,通过全景表示和分阶段成框架,提升视频时空一致性,还构建数据评测体系,实验表现优,有效率和 3D 应用潜力。

机器之心
开源动态8

Claude 终于能“看”视频了!这个开源项目让我刷视频效率翻倍

平时找视频信息效率低,而开源项目让Claude等大模型 “看懂” 视频,能提取画面、音频并理解内容。介绍了其工作原理、帧预算、去重、细节模式等,安装使用门槛低,还给出了应用场景和项目地址。

GitHubStore
算法论文8

机器人看视频学操作!伯克利首次打通互联网视频到灵巧手真机部署链路

UC Berkeley团队提出端到端流程,跑通从网络视频成真实灵巧手实机执行轨迹链路。解决了单目RGB视频手-物交互重建、带噪声参考轨迹动作重定向及遥操作规模化难题。还给出数据筛选要点。

新智元
算法论文8

EasyCache:无需训练的视频扩散模型推理加速——极简高效的视频成提速方案

近年来,扩散模型在视频成领域广泛应用,但推理慢、算力消耗高问题突出。EasyCache是无需训练的视频扩散模型推理加速方案,在多模型实验中实现大幅提速且视频质量几乎无损,为技术落地提供基础。

机器之心
产品应用8

数科技认领神秘登顶模型:AI视频公司拿出工业级Demo,跨本体跑通复杂长程任务

数科技认领神秘登顶模型MotuBrain,该模型4月中旬悄登两国际benchmark。它将预测与行动统一,具一脑多型等能力,技术上走边看边动路线,有响应快等优势。数科技双轨布局,Vidu与MotuBrain同根。

量子位
产品应用8

更快更省!Vidu Q3硬核升级打响AI视频普惠第一枪 | 甲子光年

2026年AI视频行业内容产出增长迅猛,但成本上涨、成慢等问题凸显。数科技的Vidu Q3模型全面升级,成速度提升5倍、价格降低,适配多场景,为AI视频普惠工业化提供范例。

甲子光年
产品应用8

用“蒸汽机”视频,还能音视频一体化交付?

8月21日百度营销发布百度蒸汽机2.0,含多版本,有声版可音视频一体化交付。经测试,其视频细节佳、运动规律合理。它能解决影视业诸多痛点,成本低,还可免费使用。

AI产品黄叔
开源动态8

开源 AI 视频平台

开源 AI 视频平台集成剪辑成器、AI 短视频、YouTube 工作室三大工具,能将长视频转短视频,为业务成营销视频,还具备免费 YouTube 工具包。支持多平台发布,自托管永久免费。

GitHubStore
产品应用7

LibTV这个邪修功能,大大减少AI视频抽卡次数!

作者分享在LibTV用「深度动作捕捉」功能做AI视频,将视频动作提取成深度图,可减少AI视频成失败率,且不花积分,深度图管几何,提示词管外观,提一次能用多次。

花叔
产品应用8

跨境电商版Sora发布:全球首个AI原电商视频Multi-Agent来了

营赛AI发布跨境电商版Sora——inSai Hilight。它无需拍摄素材与复杂提示词,扔个商品链接或图,20 - 30分钟就能成逻辑严密、商品还原度100%、符合TikTok爆款节奏的营销视频,重新定义电商营销视频产方式。

机器之心