「高分辨率图像」共找到 2262 篇相关文章
高管0份!影石年会5套房全归90后;34岁清华学霸28个月造百亿独角兽;DeepSeek“冷漠”争议,春节要燃回来?| Q资讯
本文为AI行业资讯汇总,包含DeepSeek回应“变冷漠”、影石年会送房、34岁清华学霸造百亿独角兽等热点,还涉及字节跳动、谷歌、英伟达等公司动态,以及模型下架、新规发布等消息。
苹果放王炸!开放大模型访问权、全家桶集成ChatGPT,人人能开发AI应用
苹果在“WWDC 2025”大会宣布在多设备集成Apple Intelligence功能,含ChatGPT图像生成等。开放基础模型访问权,开发者可开发适配应用。新功能将逐步开启测试,今年秋季部分用户可用。
谷歌Veo 3.1更新:更一致性、更具创造力和控制力
谷歌Veo 3.1发布更新,实现角色、背景与物体在动态场景中的高度一致性,支持基于参考图片创建视频、原生竖屏模式及1080p和4K分辨率升频,精准控制素材,提升创作体验。
ICCV 25 Highlight | 扩散过程「早预警」实现6x加速,AIGC生图的高效后门防御
随着AIGC图像生成技术流行,后门攻击威胁开源社区,传统防御技术难适配。本文作者来自多所高校,提出输入级防御框架NaviT2I,基于神经元激活差异检测样本,加速检测,性能优。
谷歌nano banana官方最强Prompt模板来了!先收藏再说
爆火的nano banana让更多人体验到AI对图像生成与处理的革命,网友开发出各类玩法。谷歌官方推出nano banana最强Prompt模板,涵盖写实、贴纸等6种类型,还给出调用API生图示例代码。
无需训练,即插即用,2倍GPU端到端推理加速——视频扩散模型加速方法DraftAttention
高质量视频生成任务中,扩散模型成主流,但DiT模型注意力机制计算量大,成推理瓶颈。现有加速法效果不佳,为此美国东北大学等团队提出DraftAttention,可2倍加速推理且不损画质。
一张照片,一个3D「你」:计算所等提出HumanLift,实现高保真数字人重建
中国科学院计算技术研究所等机构研究人员提出 HumanLift 技术,基于单张参考图像重建高斯网数字人全身。该技术融合三维视频扩散模型和人脸增强,仅需单张人体图片就能重建高逼真三维数字人。
字节跳动2步突破,复杂文档布局解析,为啥如此惊艳?
文章指出现有文档图像解析方案有局限,介绍字节跳动的Dolphin解决方案。它采用分析 - 解析范式分两阶段解析文档,避免传统方法弊端,运行效率高,还给出训练方案、实战代码和试用链接。
妙笔生维:线稿驱动的三维场景视频自由编辑
研究人员提出基于线稿的三维场景视频编辑方法Sketch3DVE,相关论文发表于SIGGRAPH 2025。它能让用户基于线稿重塑三维场景视频,解决了现有方法个性化不足、真实感差等问题,支持单目图像三维视频合成和二次编辑。
41个榜单SOTA!智谱最新开源GLM-4.5V实测:看图猜地址、视频秒变代码
智谱基于GLM - 4.5打造的开源多模态视觉推理模型GLM - 4.5V,在42个公开榜单中41项夺得SOTA。其功能丰富,玩法升级,还为企业与开发者提供高性价比方案,是100B参数级SOTA标杆。