开源动态8
MemoBench:捅破世界模型评测最大盲区
机器之心
AI 摘要
来自多机构的研究者提出新基准MemoBench,检测世界模型‘物体恒存’能力。测试显示现模型记忆一致性差,说明‘生成画面’与‘理解世界’差距大,为模型研发提供诊断标尺。
阅读原文 · 机器之心
世界模型评测的最大盲区,被这个新基准捅破了
过去一年,‘世界模型’成视频生成领域热词,厂商强调产品要模拟真实世界运行规律,但业界评测一直未能精准检验其‘物体恒存’的认知能力。为此,研究者提出新基准MemoBench,测试了主流模型,揭示其短板。

关注公众号
扫码关注
第一时间收到每日精选
相关文章
推荐文章7
中美对话:模型与 Agent 如何持续学习?
在新加坡 AGI Playground 2026 舞台上,AMI Labs 林敏和 Mind Lab Andrew Chen 深度对谈,探讨 Agent 如何将经验转化为能力、持续学习。两人对持续学习给出不同答案,还讨论记忆、学习等基础问题及解决办法。
Founder Park
新闻资讯7
原方智能:让机器拥有世界「信念」
原方智能正式启动,由林浩鑫与唐开强创立,技术源于 LAMDA 团队八年研究。其目标是使机器在物理世界形成对世界的'信念',以世界模型为核心技术路线,将研究成果推向开放物理世界。
机器之心
新闻资讯7
ResNet作者任少卿创业,蔚来押宝具身智能
知名AI科学家任少卿创立物理AI基础模型和具身智能独立公司,估值达独角兽级别。他虽创业仍在职蔚来,蔚来战略投资并合作。任少卿是业内早押注世界模型实战派,其创业或可视为蔚来机器人试水。
量子位
产品应用8
Wan3.0上线千问AI平台,多领域表现亮眼
今天,视频生成模型Wan3.0正式上线千问AI平台。它在多维度全面升级,公测以来收到大量反馈,获创作者、企业用户等好评。在多领域经检验表现出色,还持续进化,部分API限时7折,已被多平台接入。
阿里云开发者