视频数据集」共找到 3402 篇相关文章

开源动态8

Labubu换装记!让视频换装变得如此简单!基于扩散Transformer的视频虚拟试衣新突破

今天介绍开源项目MagicTryOn,它是基于大规模视频扩散Transformer的视频虚拟试衣框架,能实现高质量视频换装。采用三项关键技术创新,支持图像、视频试衣及定制化方案,目前仍在积极开发。

GitHubStore
算法论文8

OmniInsert:全新无掩码视频插入技术

基于扩散模型的视频插入技术发展快,但以往方法有局限。字节提出InsertPipe和OmniInsert,解决数据不足等难题。OmniInsert设计巧妙,还建立评测平台InsertBench,虽有小问题,但推理快,可加速优化。

带你学AI
开源动态8

103K「硬核」题,让大模型突破数学推理瓶颈

现有大语言模型在数学推理训练时面临数据瓶颈,腾讯AI Lab与上海交大团队推出DeepMath - 103K数据。它规模大、难度高、数据新颖、严格去污染,让DeepMath系列模型达SOTA,还能实现推理泛化。

机器之心
产品应用8

具身智能的无本体数据,终于有了自己的「代表作」

自变量机器人发布的Demo中,机器人用数百条无本体数据完成化学实验。其发布的TwinDEX系统由无本体数据系统和机器人末端执行器组成,能让无本体数据获接近真机数据的训练效果,重新定义数据逻辑。

AI科技评论
新闻资讯7

数据困局下的具身智能,谁能率先破局?

具身智能面临数据困局,Skild AI 关注真实数据不足难题。学者 Levine 称只有真实数据能达通用具身智能,而王鹤认为合成数据可助具身智能冷启动和规模化发展。遥操作和 Sim2Real 是不同技术路线。

机器之心
开源动态7

二创党福音!基于AI的开源智能视频切片处理系统

AutoClip是基于AI的开源智能视频切片处理系统,能自动从多平台下载视频、提取精彩片段并生成合。适合UP主、内容创作者等,有多平台支持、AI智能分析等特性,部署方式简单。

GitHubStore
新闻资讯8

一副手套,干翻硅谷炫技派!中国队杀入战场,狂卷100万小时数据

硅谷具身智能玩家为数据发愁,中国灵初智能另辟蹊径,用数据手套采工人操作数据,成本低且数据泛化性强。其专注物流细分场景,2026年收敛资源做深现有场景,目标推100万小时数据训练模型。

新智元
算法论文8

智源清华带来PAM,手物交互数据生成新SOTA | CVPR 2026

北京大学、清华等联合提出统一引擎PAM,能整合姿态、外观和运动。用户提供初始和目标姿态及物体几何形状,它就能生成逼真手物交互视频。其效果超现有方法,合成视频可用于数据增强。

AI科技评论
开源动态8

ICCV 2025 | UniOcc: 自动驾驶占用预测与推理统一数据及基准平台

来自多所高校团队在ICCV 2025发表统一基准框架UniOcc,融合多源数据,有体素级运动流标注等创新,提出免真值评估指标,支持协同预测,已开源,能推动自动驾驶迈向新阶段。

机器之心
算法论文8

从「找视频」到「产视频」:快手RaG推动推荐系统迈向完全生成时代

快手最新论文提出的 Recommendation-as-Generation(RaG),把推荐系统从「在已有视频里找答案」推进到「根据用户兴趣生成答案」,已在快手大规模广告系统中部署,带来广告收入提升。

机器之心