图像超分」共找到 3006 篇相关文章

算法论文8

SIGGRAPH 2025最佳论文出炉,清华、上科大、厦大获奖!谷歌拿下两篇

SIGGRAPH 2025技术论文奖项揭晓,投稿量首破970篇。5篇最佳论文涉及3D重建、图像个性化等前沿方向,清华、厦大、上科大均有入选,还有荣誉提名论文和时间检验奖论文公布。

新智元
开源动态8

自定义轨迹驱动AI视频生成,ATI无需训练适配多种生成模型

字节提出视频生成运动控制统一框架ATI,通过轻量级运动注入器将用户定义轨迹投影至预训练图像 - 视频生成模型潜在空间,实现协调控制。用户指定关键点及路径控制运动,无需重新训练,适配不同架构。

带你学AI
产品应用7

实测惊艳全球的Veo3!音画同步无敌,贵是有原因的

谷歌开发者大会推出的Veo3模型,具备强大文本和图像转视频能力,首次实现视频与音频同步生成。实测中,它生成的视频音画效果惊艳,但也有翻车情况,谷歌还给出提示词编写指南。

机器之心
算法论文8

华为中科大联创大模型低比特量化算法,1‰数据实现昇腾无损压缩7倍

华为诺亚方舟实验室联合中科大提出CBQ后训练量化方案,仅用0.1%训练数据实现大模型7倍压缩,保留99%精度。该成果登ICLR 2025 Spotlight,已加入昇腾ModelSlim工具包。

新智元
新闻资讯7

15亿美元AI独角兽崩塌,全是印度程序员冒充!微软亚马逊惨遭忽悠

Builder.ai自称用AI简化软件开发,吸引微软、软银等巨额投资,估值15亿美元。但实际靠人工冒充AI,创始人虚报营收。丑闻曝光后投资被冻结,公司破产,引发AI交易技术尽职调查讨论。

新智元
推荐文章7

一文看懂英伟达的产品体系和命名规则

文章由小枣君撰写,详细梳理英伟达产品体系和命名规则,涵盖算力芯片、级芯片、级计算机平台等,介绍各层级产品特性,还提及通信技术、开发框架CUDA,助读者清晰了解英伟达产品。

芯师爷
开源动态7

开源播客TTS神器!高效TTS模型:Muyan-TTS,0.33秒生成1秒音频,零样本语音合成!

介绍新发布的开源TTS模型Muyan - TTS,它专为播客场景设计,以低延迟实现零样本语音合成,预训练大量播客数据,支持长内容连贯生成,还介绍了使用步骤、适用场景等。

开源星探
新闻资讯7

AI Agent平台Clay获红杉资本投资,估值15亿美元

AI Agent平台Clay获红杉资本领投的员工股票回购要约,估值15亿美元。该平台过去几年增长显著,有8000客户。主打产品Claygent优势多,能自动化业务流程,还获众多知名企业高度评价。

AIGC开放社区
算法论文8

细节直逼亚毫米级!港科广层建模突破3D人体生成|CVPR 2025

港科广团队提出MultiGO创新方案,借助层建模思路突破3D人体生成难题。该方案通过三级几何学习框架提升重建质量,在多个测试集上性能领先,且在多领域有应用优势,研究成果入选CVPR 2025,项目代码将开源。

量子位
开源动态8

129K Star 的 Deepseek Harness,社区已经把桌面版、插件市场都做好了!

AI Agent 框架 Deepseek Harness 在 GitHub 上已达 129K Star。官方定位为编程 Agent 框架,社区则围绕其开发了三个项目,别是 deepseek - harness - desktop、awesome - dsh - plugin 和 dsh - desktop,拓展了使用场景与功能。

开源星探