世界记忆」共找到 1435 篇相关文章

开源动态8

刚刚,首个空间原生的具身视觉基模开源!机器人更会看我们的世界

蚂蚁灵波发布并开源了面向机器人真实任务的空间原生视觉基模 LingBot-Vision 及空间感知模型 LingBot-Depth 2.0,能让机器人更精准地感知世界,解决透明反光材质、小目标和远距离目标等视觉难题。

量子位
算法论文8

通向世界模型关键一步:EX-4D来了,实现单目视频到自由视角生成

去年Sora等模型革新视频生成领域,相机可控的视频生成技术是构建世界模型核心。但从单视角生成极端视角视频是难题,PICO - MR团队提出EX - 4D,能从单目视频生成新视角视频,多方面表现出色。

机器之心
新闻资讯8

斯坦福吴佳俊「计算机与思想奖」获奖演讲全文:从一张照片,逆推一个世界|IJCAI 2026

8月20日,斯坦福大学吴佳俊在IJCAI 2026发表“计算机与思想奖”获奖演讲。他指出像素是表象,物理结构才是因果,提出以物理代码为桥,融合基础模型泛化力与物理模拟因果性,构建视觉与物理智能。

AI科技评论
新闻资讯8

通往通用人工智能的关键一步?DeepMind放大招,3D世界最强AI智能体SIMA 2

Google DeepMind发布SIMA 2,这是能在虚拟3D世界自主游戏、推理和学习的通用AI智能体。它集成Gemini模型,从指令跟随到主动认知跃进,泛化性能提升,还具备自我提升能力,为AI和机器人技术发展提供新路径。

机器之心
产品应用7

这家公司刚成立7个月,正在打磨通用具身智能的终极形态

超维动力(Kinetix AI)于2025年7月注册,9月研发,不足一年便举办独特发布会,让KAI人形机器人“自己发布自己”。其认为高拟人是训练强世界模型前提,构建了含本体、世界模型等的技术体系,但面临工程与成本挑战。

机器之心
开源动态8

颠覆传统向量数据库,直接将文本数据编码成视频文件,轻量级革命性的大规模AI记忆解决方案Memvid

Memvid将文本数据编码为视频,改变AI记忆管理,实现百万级文本块闪电语义搜索和亚秒级检索。它存储高效、轻量级、可离线,应用场景广,还给出安装、使用、配置等说明,并与传统方案对比。

GitHubStore
新闻资讯8

LeCun怒揭机器人最大骗局,坦白Llama与我无瓜!

Meta首席AI科学家LeCun在MIT演讲称,机器人行业离通用智能还远,家用机器人需AI突破,核心是打造‘世界模型’架构。此观点引特斯拉、Figure高管回怼。他还表示LLM有本质瓶颈,世界模型将成未来AI主流。

新智元
新闻资讯8

Khosla 继 OpenAI 后的最大赌注,General Intuition 凭 38 亿个游戏高光片段做世界模型

今年10月,General Intuition完成1.34亿美元种子轮融资,由Vinod Khosla领投。它从Medal分拆,有38亿游戏短视频片段,可赋予机器“直觉和物理常识”,与LLM互补,商业化将从游戏拓展到物理世界

海外独角兽
新闻资讯7

Meta 系 95 后华人明星团队,创业一年就与高通达成合作,让手机拥有多模态记忆

由华人创业者沈俊潇创办的 Memories.ai 发布 LVMM 2.0 并宣布与高通合作,该模型 2026 年将在高通处理器上原生运行。它解决视频可搜索性问题,应用广泛,能降低延迟、确保数据安全等。

Founder Park
推荐文章8

4个月融进1亿美元、建齐3座「数据发电厂」,这家TechBio要造一个生物世界模型

原生AI TechBio公司寻明生科4个月融1亿美元,欲搭建横跨数字与生物世界的药物发现基础设施。其聚焦抗体药物设计,构建干湿实验闭环,推出AuraIDE和OpenDDE,采用“既卖引擎,也卖车”商业模式。

机器之心