算法论文7
Google DeepMind:CoF 提升视频帧间一致性
机器之心
AI 摘要
CoT 提升语言模型推理能力却遭质疑。Google DeepMind 团队提出 CoF,认为可用于视频生成模型提升帧间一致性,像视觉 GPT,经测试表现优异,还让模型有强大泛化能力。
阅读原文 · 机器之心
CoT 之后,CoF 如何让帧间逻辑从「隐式对齐」变成「显式思考」?
CoT 虽提升语言模型推理能力,但在 C 端场景有局限,且被质疑并非真实推理。视觉领域提出 CoF 概念,Google DeepMind 团队引入理论,让视频模型通过帧链推理提升帧间一致性,还具强大泛化能力。

关注公众号
扫码关注
第一时间收到每日精选
相关文章
新闻资讯8
OpenAI等用AI攻克Erdős数学难题
2026年,OpenAI等公司用AI解决多个匈牙利数学家Paul Erdős提出的问题,震动数学界。这些问题分布广、难度跨度大,适合模型测试。不过,AI证明的验证和人类数学家地位受关注。
机器之心
算法论文8
PhiZero:让AI学会「物理语言」
PhiZero由中科院自动化所团队研发,探索让AI读懂真实世界运动、交互与变化的“物理语言”。它构建Reason - then - Render框架,经大量数据训练,在多基准测试中表现领先,为AI理解物理世界开辟新通道。
机器之心
开源动态8
Alaya - EVOKE开源,可生成小时级视频
Alaya Lab等联合推出的Alaya - EVOKE能生成小时级视频,解决常见问题。它把记忆搬到模型外,改造教师模型,经多轮技术操作,实验成绩佳,给出清晰训练方案,也指出项目边界。
量子位
产品应用7
智象未来发布交互式世界模型HiDream - O1 - World
8月17日,智象未来发布交互式世界模型HiDream - O1 - World,定位为全球首款原生全模态交互式世界模型。它提供漫游和编辑两种交互方式,在WBench测试中成绩优异,但开放场景表现待验证。其采用独特生成方式,有广阔应用前景。
DeepTech深科技