算法论文8
SketchVideo让手绘视频更可控
机器之心
AI 摘要
中国科学院大学等团队:提出SketchVideo方法,基于线稿实现可控视频生成与编辑。它解决现有模型不足,可依关键帧线稿精准控制视频,提升合成可控性,让创作更简单。
阅读原文 · 机器之心
CVPR 2025 | SketchVideo让手绘动起来,视频生成进入线稿时代
中国科学院大学等团队提出基于线稿的可控视频生成和编辑方法SketchVideo,发表于CVPR 2025。它基于预训练模型添加线稿控制网络,解决现有视频生成模型可控性等问题,实现高质量视频生成与编辑。

关注公众号
扫码关注
第一时间收到每日精选
相关文章
算法论文8
PhiZero:让AI学会「物理语言」
PhiZero由中科院自动化所团队研发,探索让AI读懂真实世界运动、交互与变化的“物理语言”。它构建Reason - then - Render框架,经大量数据训练,在多基准测试中表现领先,为AI理解物理世界开辟新通道。
机器之心
开源动态8
Alaya - EVOKE开源,可生成小时级视频
Alaya Lab等联合推出的Alaya - EVOKE能生成小时级视频,解决常见问题。它把记忆搬到模型外,改造教师模型,经多轮技术操作,实验成绩佳,给出清晰训练方案,也指出项目边界。
量子位
产品应用7
智象未来发布交互式世界模型HiDream - O1 - World
8月17日,智象未来发布交互式世界模型HiDream - O1 - World,定位为全球首款原生全模态交互式世界模型。它提供漫游和编辑两种交互方式,在WBench测试中成绩优异,但开放场景表现待验证。其采用独特生成方式,有广阔应用前景。
DeepTech深科技
推荐文章8
美图影像研究院:让大众爱上用AI创作
过去两年,AI 生成图片、视频变得容易,但让 AI 理解并按创作者意图创作很难。美图影像研究院过去几年围绕高频创作场景痛点展开研究,11 篇论文被国际顶会接收,成果通过产品落地转化为 AI 影像能力。
机器之心