算法论文8
Meta:OneStory让AI会拍连贯多镜头电影
机器之心
AI 摘要
Meta与哥本哈根大学:提出OneStory用于多镜头视频生成,重构任务,设计Frame Selection和Adaptive Conditioner模块,能保持人物和环境一致,为视频生成提供新思路。
阅读原文 · 机器之心
CVPR 2026|AI开始会拍电影了:一分钟十镜头,全程不崩剧情
多镜头视频生成要求模型处理不同镜头间稳定信息和变化信息,现有方法有局限。Meta与哥本哈根大学研究者提出OneStory,建立跨镜头记忆机制,设计关键模块,实验表现好,为视频生成打开新可能。

关注公众号
扫码关注
第一时间收到每日精选
相关文章
产品应用8
Meta推编码框架,低价换开发者数据
Meta推出Muse Code编码框架及Muse Spark 1.2模型,有不同输入输出、功能和性能表现。提供不同档位价格,贡献者档位低价但数据用于训练。测试显示其单任务成本低,Meta此举或为获取编码训练数据。
DeeplearningAI
算法论文8
PhiZero:让AI学会「物理语言」
PhiZero由中科院自动化所团队研发,探索让AI读懂真实世界运动、交互与变化的“物理语言”。它构建Reason - then - Render框架,经大量数据训练,在多基准测试中表现领先,为AI理解物理世界开辟新通道。
机器之心
开源动态8
Alaya - EVOKE开源,可生成小时级视频
Alaya Lab等联合推出的Alaya - EVOKE能生成小时级视频,解决常见问题。它把记忆搬到模型外,改造教师模型,经多轮技术操作,实验成绩佳,给出清晰训练方案,也指出项目边界。
量子位
产品应用7
智象未来发布交互式世界模型HiDream - O1 - World
8月17日,智象未来发布交互式世界模型HiDream - O1 - World,定位为全球首款原生全模态交互式世界模型。它提供漫游和编辑两种交互方式,在WBench测试中成绩优异,但开放场景表现待验证。其采用独特生成方式,有广阔应用前景。
DeepTech深科技