「互联网视频数据」共找到 3397 篇相关文章
ECCV'26 | 为视频虚拟试衣解锁自由视角,TryOnCrafter玩转4D试衣代理
现有视频虚拟试衣方法受限于固定相机视角,难以满足用户自由观察需求。本文提出 TryOnCrafter 框架,定义可控相机视频虚拟试衣任务,引入可渲染 4D 试衣代理,支持多种下游应用,为虚拟试衣开辟新路径。
从 AI 取数到智能分析:企业级数据 Agent 的多阶段演进与工程化落地
文章整理自 Shopee 技术专家王新波在 QCon 全球软件开发大会 2026 北京站的分享。复盘团队打造企业级 Data Agent 实践,揭示技术演进路径,分享将取数工具雕琢为智能分析工具的方法。
神秘具身团队又放出一连串很炸的Demo视频…自进化模型,技术路线曝光
神秘具身团队放出一连串Demo视频,其内部代号“MVP”的模型让机器人似人般思考决策。视频展示机器人在不同场景下的表现,如躲避推搡、做家务、机器人协作、高效收纳等,体现对物理规则和人类习惯的理解与自进化能力。
小米模型实现声音理解新SOTA!数据吞吐效率暴增20倍,推理速度快4倍 | 全量开源
小米全量开源MiDashengLM - 7B模型,它基于Xiaomi Dasheng和Qwen2.5 - Omni - 7B Thinker,实现声音理解新SOTA。性能领先,推理效率高,革新训练范式,全栈开源,将赋能多场景。
AI出码率70%+的背后:高德团队如何实现AI研发效率的量化与优化
文章围绕建立统一数据采集和指标体系,搭建AI统一数据采集能力,定义AI出码率等核心指标,构建AI效率研发指标体系,还介绍了数据采集方案、指标计算等,实现数据驱动闭环。
从被100家VC拒绝到英伟达、字节抢着投,AI视频独角兽CEO揭秘“奇葩”用人哲学:不招精英
Synthesia是专注企业级AI视频方案的平台,愿景是让会用PPT的人轻松做视频。创业初被100位投资者拒绝,获Mark Cuban支持后走上正轨。产品受众多公司使用,ARR破1亿美元,还获英伟达、字节等投资,CEO用人不招精英。
英伟达让机器人「做梦学习」,靠梦境实现真·从0泛化
英伟达推出DreamGen项目,让机器人‘做梦学习’。它利用视频世界模型生成神经轨迹,仅少量现实视频就能让机器人学会新任务,实现从0泛化,还将助力GR00T - Dreams发展。
ICLR神秘论文曝光!SAM3用「概念」看世界,重构视觉AI新范式
2023年Meta推出SAM,后SAM 2扩展到视频分割。近日,SAM 3现身ICLR 2026盲审论文,带来「基于概念的分割」新范式,强调按「语义概念」理解和分割图像,还构建数据引擎提升性能。
Index-AniSora:B站开源动画生成模型,斩获多项SOTA入选IJCAI25
B站开源动画视频生成模型Index - AniSora,支持多种二次元风格视频镜头一键生成。基于AniSora系统,全面提升动画生产效率与质量,开源内容丰富,还构建奖励数据集和奖励模型提升对齐性能。
效果逼真到让人窒息!开源Ctrl-Crash模拟车辆事故
近年来视频扩散技术在生成车辆碰撞真实场景时面临挑战,因驾驶数据集中事故样本稀缺。Mila团队提出Ctrl - Crash可控碰撞视频生成模型,支持反事实场景生成,但也存在一些局限。