「统一记忆分类学」共找到 981 篇相关文章
NeurIPS 2025|VFMTok: Visual Foundation Models驱动的Tokenizer时代来临
传统视觉 Tokenizer 存在缺乏高层语义信息、冗余度高、表征混乱等问题。香港大学 CVMI Lab 和阶跃星辰 AIGC 团队提出 VFMTok,用预训练视觉基础模型构造视觉 Tokenizer,实验显示其性能优异。
景不动人动,MLLM如何面对「移步换景」的真实世界?OST-Bench揭示多模态大模型在线时空理解短板
上海多所高校研究者提出 OST - Bench,从智能体探索场景动态在线视角挑战大模型能力。它更贴近真实世界,揭示主流多模态大模型在线时空理解短板,为未来模型发展指明方向。
李飞飞押注的3D世界模型黑科技,被这篇论文一次性扒光!
李飞飞创业公司World Labs发布空间智能模型成果,推出Marble平台。本文分享3D、4D世界模型技术综述,系统梳理原生表示的世界模型,给出分层分类法、数据集与评测指标,并开源维护。
AI教父Hinton诺奖演讲首登顶刊!拒绝公式,让全场秒懂「玻尔兹曼机」
2024年12月8日,诺贝尔物理学奖得主Hinton发表《玻尔兹曼机》演讲,内容于8月25日登APS期刊。他介绍‘霍普菲尔德网络’,分享创新应用,提出‘玻尔兹曼机学习算法’,后有受限玻尔兹曼机等成果,‘玻尔兹曼机’曾催化深度学习革命。
用了半年的MCP,它不是“USB-C”,而是企业AI落地的噩梦!
文章指出MCP虽曾被视为AI界USB - C接口,但企业落地时问题诸多,如类型安全靠猜、标准协议名存实亡、调试困难等,还给出企业级MCP落地自查清单。
飞书MCP不好用?我一天自研了人生教练MCP (v3.0)| 附:我的AI启发
作者因飞书MCP更新与期望不符,花一天自研人生教练MCP组件。介绍了人生教练Agent特点,还给出启动方法,最后分享在MCP实践中发现的AI趋势及实践总结。
扩散语言模型扛把子LLaDA迎来新版本,数学、代码、对齐能力均提升
中国人民大学与蚂蚁集团团队基于前期 8B 扩散语言模型 LLaDA,提出方差缩减的偏好优化方法 VRPO,推出 LLaDA 1.5。它在数学、代码、对齐任务上性能提升,VRPO 为扩散语言模型对齐提供框架。
大模型玩不好数独?!Transformer作者初创公司公布排行榜:o3 Mini High“变异数独”正确率仅2.9%
Transformer作者初创公司Sakana AI公布AI解决数独能力排行榜,用全新基准Sudoku - Bench考验大模型创造性推理能力。结果显示大模型总体正确率仅15%,9×9数独中高性能模型o3 Mini High正确率2.9%。
Claude骂声中启动「隐形水印」:新模型全量嵌入,标记所有文字
Anthropic宣布新款Claude将在生成文本中嵌入隐形水印,还会给特定文件附加数字签名元数据,全球统一施行。此前A社就用Unicode贴暗标,虽称不影响生成质量,但遭质疑。
AI短片节创作者招募:在崇礼,用AI讲一个未来故事|甲子光年
「Future Now/未来此刻」2026夏季崇礼论坛将启幕,设立「Chongli AI Film Lab」专场论坛,发起AI短片节。面向全球创作者征集作品,有两大创作方向,生数科技Vidu全程支持,对作品有要求,还有丰厚奖励。