长视频数据」共找到 3757 篇相关文章

算法论文8

单卡4090也能高质量视频编辑!西湖AGI Lab无训练框架FlowDirector来了

视频编辑门槛高、现有方法开销大且效果不佳。西湖大学AGI Lab团队提出无需训练的FlowDirector框架,可将基于流的视频生成模型改造成编辑工具,质量高、功能广、开销低,解决了时序、结构和编辑幅度问题。

机器之心
算法论文8

CVPR2025视频生成统一评估架构,上交x斯坦福联合提出让MLLM像人类一样打分

Video-Bench视频评估框架由上海交通大学、斯坦福大学等团队提出,能让MLLM像人一样评估视频。它构建双维度评估框架,引入链式查询和少样本评分技术,突破现有评估方法限制,更全面智能地评分。

量子位
产品应用7

10人团队千万融资,这个原生AI产品要做“人人可用的数据Agent”丨对话ChatExcel

ChatExcel是国内首款原生AI DataAgent,专注自然语言对话处理分析数据。其不到10人团队获近千万融资,定位平民化数据产品,核心是多模型结合,已近百万用户,正拓展海外市场。

量子位
算法论文8

绝对零监督Absolute Zero:类AlphaZero自博弈赋能大模型推理,全新零数据训练范式问世

清华大学 LeapLab 团队等提出全新推理训练范式 Absolute Zero,使大模型实现「自我进化式学习」。基于此范式训练的模型 AZR,在代码生成与数学推理基准任务表现出色,缓解了大模型对人工数据依赖难题。

机器之心
开源动态7

马斯克点赞的APP来了!刚下场视频世界模型,就拿下评测第一

实时视频世界模型成热门,Loopit发布的实时互动世界模型Zing - 0.5在评测中获第一且已开源。该公司提出独特观点,认为实时视频非世界,互动应“模应一体”,还指出抵达端到端终局的新路径。

新智元
算法论文8

统一视觉多模态与多任务!快手可灵与港科大团队发布视频生成模型,加速真实世界理解

港科大、港中文、清华和快手可灵团队提出全新视觉框架UnityVideo,统一训练多种视觉模态,让模型更懂物理规律,视频生成更真实可控,还实现零样本泛化,在多任务表现优异。

量子位
产品应用8

一手评测Seedance 1.0 pro,字节首次登顶视频大模型竞技场的大杀器来了。

作者在火山引擎发布会现场,认为视频生成模型Seedance 1.0 pro最酷。从多镜头组合、运动质量、情绪、运镜、物理动态效果、风格化六个维度测评,该模型各方面表现出色,无明显短板,已开放给企业用户,今日在豆包App全量上线。

数字生命卡兹克
开源动态8

先解行为,再训Agent:CMU开源首份Agentic Search日志数据,把Agent拆开给你看

CMU团队基于DeepResearchGym平台,从半年真实流量中整理出数据,构建并在Hugging Face开源首个Agentic Search行为日志数据集。还提出三层分析框架,刻画智能体搜索行为,为研究和系统设计提供基础与信号。

机器之心
开源动态8

从分钟级等待到20倍超速:LightX2V重写AI视频生成速度上限

今年,开源项目LightX2V在ComfyUI社区走红,单月下载超170万次。它是面向低成本、强实时视频生成的推理技术栈,能在消费级显卡上高效生成视频,还支持多种模型和硬件,覆盖不同用户需求。

机器之心
开源动态8

全景视觉的Depth Anything来了!Insta360推出DAP,200万数据打造全场景360°空间智能新高度

Insta360等团队推出全景度量深度基础模型DAP,构建200万量级全景数据引擎,设计三阶段伪标签管线,在模型架构上也有创新,在多项测试中效果优异,项目代码与模型已开源。

机器之心