图像到视频」共找到 3225 篇相关文章

产品应用8

都在问世界模型怎么落地,PixVerse把答案做成了「好玩」

互动式娱乐市场正在爆发,PixVerse推出实时视频世界模型R2版本。该版本让用户真正和世界交互,解决实时视频世界模型持续scaling问题,从内测case来看玩法丰富,其底层技术也有大幅改进。

机器之心
算法论文8

一个模型统一4D世界生成与重建,港科大One4D框架来了

港科大研究团队提出 One4D 框架,可统一 4D 生成与重建,构造同步输出多模态的视频扩散模型,支持多种任务形态。其有 DLC、UMC 等亮点,用合成与真实数据混合策略训练,实验表现佳。

机器之心
算法论文8

比Sora更疯狂!英伟达AI让机器人「做梦」修炼,无师自通直接上岗

英伟达新研究项目DreamGen用视频生成模型让机器人在神经网络生成的「梦境世界」自主探索学习。它能让机器人掌握新动作、泛化新环境,合成数据暴涨333倍,还引入DreamGen Bench用于视频生成基准。

新智元
开源动态7

LangChain Memory 太弱?试试用 MemOS 构建 Agent 专属的“记忆图谱”。

文章聚焦 MemOS 开源框架,深入体验其记忆“图谱”能力,探讨将它集成基于 LangChain1.x 框架构建的智能体的方法。介绍了基于记忆“图谱”构建 ChatBot、体验记忆“图谱”自动重组,以及集成 LangChain 智能体等内容。

AI大模型应用实践
新闻资讯8

北大南开数学家解决著名“十杯马天尼”问题:更统一、更优雅的证明

困扰数学和量子力学交叉领域半个世纪的“十杯马天尼”问题,虽2005年被数学家给出完整证明,但原证明依赖特殊对称性,难以推广现实。北大葛灵睿、南开尤建功加入研究,将结论推广更大类准周期算子,给出更优雅统一证明。

量子位
推荐文章7

入局AI Infra:程序员必须了解的AI系统设计与挑战知识

文章分享传统后台工程师技术栈和方法论如何迁移AI系统,系统性拆解AI Infra的硬件、软件、训练和推理挑战,如硬件从CPUGPU、软件依赖深度学习框架,还分析训练和推理面临的问题及解决办法。

腾讯技术工程
产品应用8

Sora被拉下神坛:PixVerse这款AI视频工具用最低价拿下全球质量第一

所有人以为Sora是AI视频生成天花板,但现在质量排名第一的是PixVerse,它登顶Product Hunt日榜第一。其质量评分超Sora 168分,价格还低20%,且在多方面升级。大众仍认为Sora最强有认知、品牌、信息等因素。

AI Reading Hub
算法论文8

最新研究揭示视觉模型与人脑的对齐机制

FAIR与巴黎高等师范学院通过训练自监督视觉Transformer模型(DINOv3),评估脑 - 模型相似性。发现模型大小、训练数据量和图像类型影响相似度,DINOv3学的表征会逐步与人脑一致。

量子位
新闻资讯8

ImageNet作者苏昊被曝任教复旦

ImageNet作者之一苏昊被曝要去复旦任教。他是具身智能领域论文被引次数最高的华人学者,主导多个奠基级项目。他研究从语言2D、3D视觉,再机器人,还创办具身智能公司Hillbot。

量子位
算法论文7

ICCV2025 | 多视图生成新范式-利用自回归模型探索多视图生成

本文介绍自回归生成多视图图像方法 MVAR,能从先前视图提取引导信息增强一致性,拉近与基于扩散方法的图像质量差距。解决了多模态条件控制和数据有限问题,展示出强指令遵从与多视角一致性。

机器之心