多视角」共找到 4210 篇相关文章

产品应用8

证明也有「选择困难症」?腾讯AI Lab与大模型研究部联手打造 MPS-Prover ,多视角破解形式化推理瓶颈!

本文聚焦逐步式自动化定理证明器困境,腾讯AI Lab等提出MPS - Prover。它有数据筛选和多视角树搜索两项创新,提升搜索效率和证明质量,在基准表现佳,还解决六道IMO难题。

AI科技评论
算法论文8

用2D数据解锁3D世界:首个面向运动学部件分解的多视角视频扩散框架

张昊等提出 Stable Part Diffusion 4D (SP4D) 框架,由 Stability AI 与 UIUC 联合完成。它能从单目视频生成多视角 RGB 与运动学部件序列,解决运动学部件分解及自动 rigging 问题,实验效果显著,被 Neurips 2025 接受为 Spotlight。

机器之心
算法论文7

ICCV2025 | 视图生成新范式-利用自回归模型探索视图生成

本文介绍自回归生成视图图像方法 MVAR,能从先前视图提取引导信息增强一致性,拉近与基于扩散方法的图像质量差距。解决了模态条件控制和数据有限问题,展示出强指令遵从与多视角一致性。

机器之心
产品应用7

全球首个跨本体、跨视角模态物理世界模型,CurrentWorld-0 来了!

Current Robotics 发布跨本体、模态物理世界模型 CurrentWorld-0,它从真实数据学规律,整合跨本体、多视角和力触预测,可评测机器人,解决动作可控性等问题,让评测成训练数据入口。

机器之心
算法论文8

首次实现第一视角视频与人体动作同步生成!新框架攻克视角-动作对齐两大技术壁垒

新加坡国立大学等联合发布EgoTwin,首次实现第一视角视频与人体动作联合生成,攻克视角 - 动作对齐与因果耦合瓶颈。它基于扩散模型,通过三大创新设计解决核心难题,实验性能超基线,为领域应用提供落地基座。

量子位
产品应用7

Harness Monitor:当个 Agent 同时写代码时,如何看住质量

作者在有了 OpenAI 赞助的 Codex Pro 后,让个 Agent 同时在一个代码库工作。他开发的 Harness Monitor 从 Git 视角出发,解决 Agent 写代码时的质量问题,涉及观察、治理等方面能力。

phodal
算法论文8

告别奖励跷跷板:Flow-OPD将教师OPD带入图像生成

中国科学技术大学等机构团队提出Flow - OPD,这是首个将OPD引入流匹配模型的统一任务后训练框架。它解决了流匹配模型后训练对齐中任务的梯度冲突等问题,效果良好,未来有个拓展方向。

机器之心
算法论文8

首次实现第一视角视频与人体动作同步生成!新框架攻克视角-动作对齐两大技术壁垒

新加坡国立大学等联合发布EgoTwin框架,首次实现第一视角视频与人体动作联合生成,攻克视角-动作对齐与因果耦合瓶颈。它基于扩散模型,通过三大创新设计解决难题,实验性能超基线。

量子位
算法论文8

ACL'25 | 智能体叛变进行中?首个智能体安全守卫G-Safeguard亮相!

随着基于LLM的智能体系统崛起,其安全隐患凸显。中国科学技术大学等机构提出G - Safeguard安全防护框架,它基于图神经网络,通过构建智能体话语图等方式,能有效抑制恶意信息传播,有强大防御和泛化能力。

PaperAgent
开源动态7

谢赛宁也玩MC?开源全新世界模型生成人一致的游戏视角

电子游戏推动AI发展,谢赛宁团队探索世界模型新方向,推出人视频世界模型Solaris。该模型能生成人一致的第一视角,团队还搭建了人数据采集系统SolarisEngine,构建了人Minecraft数据集。实验结果显示,其方法在方面表现更优。

机器之心
上一页1 / 421下一页