Video Plan」共找到 98 篇相关文章

产品应用7

OpenClaw现在可以直接生成视频了,支持12家视频模型提供商

Peter Steinberger宣布OpenClaw新版推视频生成功能,让Agent完成文本到视频流程。它集成12家视频生成提供商,异步生成,使用简单,支持丰富参数配置,官方文档见https://docs.openclaw.ai/tools/video-generation 。

AI工程化
算法论文8

ICLR 2026 | 当视频难以被表征:UCSD、HKUST等机构联合提出FlowRVS,用生成式流匹配重构视觉感知范式

计算机视觉领域传统表征方法在视频处理上力不从心,SGIT AI Lab等机构团队提出FlowRVS,跳出传统桎梏,用生成式流匹配重构视觉感知范式,实现SOTA提升,还展现诸多优势,证明Flow Matching理论普适性。

机器之心
算法论文8

AAAI 2025 Oral | 火山引擎多媒体实验室提出VQ-Insight,AIGC视频画质理解大模型

火山引擎多媒体实验室与北大合作论文《VQ-Insight: Teaching VLMs for AI-Generated Video Quality Understanding via Progressive Visual Reinforcement Learning》入选AAAI 2026口头汇报。VQ - Insight用渐进式框架处理AIGC视频画质理解,实验表现卓越。

机器之心
开源动态8

一个能思考、会记忆的AI导演诞生了!新加坡管理大学,香港中文大学等实现故事化视频生成

新加坡管理大学等提出开源全能多智能体框架UniVA,可统一视频理解、分割等能力,按指令生成完整故事视频。还引入UniVA - Bench基准测试套件,实验显示其在多任务中表现出色,代表视频智能生成重要进步。

AIGC开放社区
产品应用8

谷歌重磅发布Flow,人人都能制作好莱坞级电影

谷歌在‘I/O 2025’大会发布影视级AI制作工具Flow,它是Video FX迭代版,由Veo 3、Imagen和Gemini支持。具备专业影视制作功能,已有知名制作人用其产出高质量作品,已开放使用。

AIGC开放社区
算法论文8

小红书RecSys 2025最佳论文提名背后:破解视频时长预测难题

小红书推荐算法团队论文《Multi-Granularity Distribution Modeling for Video Watch Time Prediction via Exponential-Gaussian Mixture Network》在 RecSys 2025 获最佳论文提名。该文剖析视频时长预测难题,提出 EGMN 模型,线下线上验证效果佳。

机器之心
开源动态8

视频世界模型困在像素网格里:腾讯开源SCoPE,用射线空间重写位置关系

香港大学、香港科大与腾讯ARC Lab联合提出SCoPE,让视频模型处理位置关系的基底从张量网格转向射线空间。它将相机射线坐标注入Video DiT,新增参数不到原模型0.1%,多方面表现获改善。

机器之心
新闻资讯7

罗福莉:Claude订阅封杀龙虾背后,真正的出路不是更便宜的token

Anthropic宣布Claude Pro和Max订阅用户不得将额度用于第三方Agent框架,引发各方反应。Xiaomi MiMo大模型负责人罗福莉指出,当前token计费模式难应对挑战,需更优算力使用方式,还介绍了小米MiMo Token Plan

机器之心
算法论文8

机器人终于「懂」家务了!伯克利MomaGraph让机器人像人一样做家务

过去家用机器人做家务存在诸多难题,最近加州伯克利和马里兰大学联手推出 MomaGraph 技术。该技术采用「Graph - then - Plan」思路,团队搭建了完整体系,在星动 Q5 上测试效果好,让家用服务机器人迈向实用。

机器之心
产品应用7

基于Agent的SGLang Diffusion Kernel优化实践:Qwen-Image、FLUX.2和视频模型

本文记录基于Agent完成Qwen-Image、FLUX.2、Wan和SANA Video优化的过程,包括定位问题、写Kernel及遇到的坑。介绍SGLang Diffusion Kernel结构,分析数值敏感原因,展示各模型优化实践、无收益实验及验证流程。

GiantPandaLLM