物理一致性」共找到 593 篇相关文章

开源动态8

一张图0.1秒生成上半身3D化身!清华IDEA新框架入选ICCV 2025

清华和IDEA研究人员提出新框架GUAVA,可0.1秒从单图创建上半身3D化身。它解决了现有方法在ID一致性、效率等方面的局限,实验显示其在渲染质量和效率上优于现有2D和3D方法,代码已开源。

量子位
算法论文8

ICCV 2025 | 小红书AIGC团队提出图像和视频换脸新算法DynamicFace

小红书AIGC团队提出图像和视频换脸新算法DynamicFace。该算法创新性融合扩散模型与3D人脸先验,解耦身份与运动信息,设计双流注入架构和时序一致性模块,实验证明其在身份保真与运动还原上优势明显。

机器之心
产品应用8

今年最难的机器人Demo,“机器人含量”为0

自变量发布全新灵巧操作系统TwinDex,后训练阶段真机遥操数据为0,机器人就能完成多项精细操作。该系统设计有灵巧性、一致性和可扩展性,降低了对真机遥操数据的依赖,使高质量数据与真机遥操的强绑定松动。

量子位
新闻资讯8

AI进入深水区:资本如何重新定义下一轮生产力跃迁?|甲子光年

2026年3月29日,“AI未来论坛:跃迁·投资·共生”将在中关村国际创新中心海慧厅举办。论坛聚焦AI从数字原生向物理世界渗透、资本投资逻辑等问题,有投资大咖对话、前沿项目展示等环节,海淀区还将发布投资生态伙伴计划。

甲子光年
算法论文8

离职特斯拉“隐身”14个月,杨硕创业终于亮牌:重新定义机器人训练范式

杨硕从特斯拉擎天柱团队离职创业一年多后,妙动科技团队带来新论文《DiT4DiT: Jointly Modeling Video Dynamics and Actions for Generalizable Robot Control》。该团队用视频训练机器人动作,提出DiT4DiT模型,解决VLA模型不懂物理问题,在人形机器人上有新突破。

量子位
产品应用8

谷歌Nano Banana Pro上线,深度结合Gemini 3,这下生成世界了

谷歌最新图像生成模型Nano Banana Pro(Gemini 3 Pro Image)上线,结合Gemini 3 Pro强大推理与知识,在控制力、文字渲染和世界知识方面升级,能生成高分辨率、一致性强图像,还支持创意操控、多语言文本生成等,多产品将上线。

机器之心
新闻资讯8

突破125年世纪难题!北大校友联手科大少年班才子破解希尔伯特第六问题

1900年希尔伯特提出23个数学难题,其中第六个‘物理学的公理化’被称为数学物理的终极挑战。125年后,北大校友邓煜、中科大少年班马骁与陶哲轩高徒扎赫尔・哈尼在该问题上取得重大突破,填补了牛顿力学与玻尔兹曼方程间的逻辑鸿沟。

量子位
新闻资讯7

3个月融资亿元,流形空间证明世界模型也需要预训练 | 甲子光年

2025年5月武伟创办流形空间,成立3个月获亿元融资。他认为VLA是过渡方案,世界模型是AGI新基建。当下技术分显式物理建模和隐空间交互两派,流形空间做具身世界模型,从预训练做起,还将领域模型产品化。

甲子光年
新闻资讯7

智元办机器人挑战赛:清华&上海AILab夺冠,华南理工“单人成团”拿亚军

由智元机器人联合OpenDriveLab举办的AGIBOT World Challenge线下决赛在杭州IROS落幕。全球11支顶尖队伍在六大真实物理任务中角逐,清华联合上海AILab团队夺冠,华南理工、港大团队分获二、三名。智元还展示了产品线,精灵 - G2首次公开亮相。

量子位
产品应用7

AI 视频生成“试金石”:谷歌 Veo 3 体操“图灵测试”未达标,仍是“抽象派”!

谷歌新出的Veo 3视频生成模型画质惊艳且能开口说话,但生成体操动作效果差,像“抽象派”。虽存在生成不准问题,但物理效果比其他模型好。有人建议其与专业动捕公司合作,音画一体或成视频模型竞赛标配。

AI进修生