算法论文8
南洋理工VChain:让视频生成懂物理逻辑
机器之心
AI 摘要
南洋理工大学团队:提出VChain框架,将大模型推理能力注入视频生成,分三步实现,实验效果显著,展示视频推理与生成趋势,为多模态协作提供方向。
阅读原文 · 机器之心
ACL 2026 | 赋予视频生成「视觉思维链」:VChain显式建模时空规划与状态演变
南洋理工大学团队在ACL 2026发表VChain框架,引入大模型视觉推理能力提升视频逻辑连贯性。它分三步实现,实验效果超现有方法,还展示视频推理与生成的潜在趋势,为多模态模型协作提供范例。

关注公众号
扫码关注
第一时间收到每日精选
相关文章
算法论文8
PhiZero:让AI学会「物理语言」
PhiZero由中科院自动化所团队研发,探索让AI读懂真实世界运动、交互与变化的“物理语言”。它构建Reason - then - Render框架,经大量数据训练,在多基准测试中表现领先,为AI理解物理世界开辟新通道。
机器之心
开源动态8
Alaya - EVOKE开源,可生成小时级视频
Alaya Lab等联合推出的Alaya - EVOKE能生成小时级视频,解决常见问题。它把记忆搬到模型外,改造教师模型,经多轮技术操作,实验成绩佳,给出清晰训练方案,也指出项目边界。
量子位
产品应用7
智象未来发布交互式世界模型HiDream - O1 - World
8月17日,智象未来发布交互式世界模型HiDream - O1 - World,定位为全球首款原生全模态交互式世界模型。它提供漫游和编辑两种交互方式,在WBench测试中成绩优异,但开放场景表现待验证。其采用独特生成方式,有广阔应用前景。
DeepTech深科技
算法论文8
0.01%参数,大模型低数据微调新方案
瑞典隆德大学与Google DeepMind团队研究大模型微调省参方案。发现低数据场景下,微调Value投影中的b(v)比b(q)或b(k)性能更好。该研究已被ACL 2026接收,集成进Hugging Face - PEFT库。
量子位