图像修复」共找到 615 篇相关文章

开源动态8

CVPR 2026 | 谷歌DeepMind重磅开源多模态TIPSv2:实现Patch-Text对齐的最优表现

谷歌DeepMind推出多模态TIPSv2,解决图像块与文本嵌入对齐难题。它有三大核心技术创新,在9项任务和20个数据集表现出色,特征图优势显著,且配套生态完善,为AGI预训练指明方向。

机器之心
算法论文8

加速近5倍!北大与字节团队提出BranchGRPO,用「树形分叉 + 剪枝」重塑扩散模型对齐

北京大学与字节团队提出 BranchGRPO 新型树形强化学习方法,通过在扩散反演中引入分叉与剪枝,解决扩散/流匹配模型人类偏好对齐难题。该方法在图像与视频生成任务中表现优异,迭代时间最高近 5 倍加速。

机器之心
算法论文8

妙笔生维:线稿驱动的三维场景视频自由编辑

研究人员提出基于线稿的三维场景视频编辑方法Sketch3DVE,相关论文发表于SIGGRAPH 2025。它能让用户基于线稿重塑三维场景视频,解决了现有方法个性化不足、真实感差等问题,支持单目图像三维视频合成和二次编辑。

机器之心
新闻资讯7

4万多名作者挤破头,CVPR 2025官方揭秘三大爆款主题, 你卷对方向了吗?

CVPR 2025 官方根据 4 万多名作者 13008 份投稿,总结出计算机视觉热门的三大方向,即基于多视角与传感器的 3D 技术、图像与视频合成、多模态学习(视觉、语言和推理),并介绍了各方向热门原因。

机器之心
推荐文章8

AI热点选品:当推荐系统遇上“热点”,我们需要一场变革

文章指出当下推荐系统追踪热点滞后,存在时效、解码、迭代困境。为此启动热点AI选品项目,构建自动化热点响应系统,经多环节处理输出优质候选集,还介绍成果、后续优化方向及AIGC图像生成方案。

阿里云开发者
新闻资讯7

AI可观测行平台Lightrun,获7000万美元

AI可观测性平台Lightrun获7000万美元B轮融资,由Accel和Insight Partners领投。它改变传统监测工具局限,实现实时调试修复。连续三季成G2领域领导者,获众多企业信赖,发展迅猛。

AIGC开放社区
算法论文8

116页论文教你「蒸馏」Claude、GPT-5.6:AI社区今天炸了

一篇前沿大模型安全漏洞论文引发热议,指出各大模型 API 设计缺陷,可提取隐藏思维链。同一模型家族安全能力不对称,攻击者可利用此漏洞,还介绍了攻击路径、实验及修复建议。

机器之心
8

一天 15k 星,代码生成碾压 Claude,连 Cursor 都慌了?谷歌 Gemini CLI 杀疯了

谷歌发布 Gemini CLI,是其 AI 助手终端版,有慷慨免费使用配额。它开源且功能多,支持多平台。接入 Gemini 2.5 Pro 通用模型,开发者反馈其代码生成和修复能力强,谷歌在代码能力上提升明显。

InfoQ
算法论文8

NTU S-Lab 团队探索可动 3D 新方向:结构、关节、纹理一次到位

南洋理工大学 S-Lab 团队发布研究,提出统一建模框架,能从单张图像生成可动三维对象,在几何精度、外观一致性与运动合理性上显著提升,解决了现有方法的难题,为相关领域发展奠定基础。

AI科技评论
新闻资讯7

The Batch: 839 | 好莱坞加入 AI 版权之争

好莱坞电影公司加入对用其版权作品训练AI模型公司的抗争。迪士尼和环球起诉Midjourney,指控其未经授权用版权作品训练模型、分发含其角色图像,请求停侵权并索赔,版权法相关界定尚不明确。

DeeplearningAI