算法论文8
CVPR 2026:视频模型竞争重心转移
AI科技评论
AI 摘要
CVPR 2026 显示,视频模型竞争重心从视觉质量转向对时空和物理规律的建模。如 MotionV2V 推进视频编辑到“改运动”,AdapTok 解决视频高效表示,还有热成像分离、地球观测模型等成果。
阅读原文 · AI科技评论
CVPR 2026 视频模型趋势梳理:不止生成下一帧,更要理解下一步
视频智能正从画面生成走向运动控制、动态建模等。CVPR 2026 显示视频模型竞争重心从视觉质量转向对时空和物理规律的建模能力,文中介绍多篇相关论文及成果。

关注公众号
扫码关注
第一时间收到每日精选
相关文章
产品应用7
Agent助力Diffusion模型多方面优化
本文记录基于Agent完成Qwen-Image、FLUX.2、Wan和SANA Video优化的过程,包括定位问题、写Kernel及遇到的坑。介绍SGLang Diffusion Kernel结构,分析数值敏感原因,展示各模型优化实践、无收益实验及验证流程。
GiantPandaLLM
开源动态7
新视频模型发布,视频Agent竞争升级
7月31日MiniMax H3和字节跳动Seedance 2.5同日发布,3天后H3开源,8月7日Seedance 2.5开放api。模型变强使产品层要做的事更多,视频Agent需解决生产问题,竞争走向模型层之上。
Founder Park
产品应用8
MiniMax H3 开源,视频创作成本大降
本文实测 MiniMax H3 视频模型,它 8 月 3 日开源,成本低至 0.5 元/秒,在编辑榜成绩佳。它定位全模态生成,能多素材输入。实测效果好,价格约为 Seedance 2.5 的三分之一,还支持原生剪辑,适配多芯片与工具。
特工宇宙
算法论文8
ReSAM:1点标注让SAM学会分割遥感图像
CVPR 2026收录论文《ReSAM: Refine, Requery, and Reinforce: Self-Prompting Point-Supervised Segmentation for Remote Sensing Images》,提出让SAM每个目标只标1个点,通过R³循环自己生成高质量伪标签训练。在WHU建筑数据集上,1点标注与全监督差距仅1.3%,省99%标注成本。
机器学习AI算法工程