图像去水印」共找到 675 篇相关文章

产品应用8

Nano Banana Pro上线!集成Gemini 3与Veo 3,谷歌不给竞争对手喘息机会

谷歌推出最强文生图模型Nano Banana Pro,又名Gemini 3 Pro Image,整合Gemini 3 Pro多模态理解能力与谷歌搜索知识库。它提升文字渲染等能力,支持多种分辨率和格式,还集成视频生成模型,覆盖多类用户。

量子位
开源动态8

NVIDIA开源“Banana”级黑科技!会懂物理、理解时间的图像编辑模型!

继谷歌Banana后,英伟达开源物理级图像编辑模型ChronoEdit - 14B,被称‘NVIDIA版的Banana’。它有‘时间观念’和‘物理常识’,能按描述生成符合物理规律图像,适用于多领域。

开源星探
开源动态8

41个榜单SOTA!智谱最新开源GLM-4.5V实测:看图猜地址、视频秒变代码

智谱基于GLM - 4.5打造的开源多模态视觉推理模型GLM - 4.5V,在42个公开榜单中41项夺得SOTA。其功能丰富,玩法升级,还为企业与开发者提供高性价比方案,是100B参数级SOTA标杆。

新智元
新闻资讯7

刚刚,Ilya Sutskever宣布自任CEO:联创被Meta挖走了

周五凌晨,OpenAI 联合创始人 Ilya Sutskever 宣布自任 Safe Superintelligence(SSI)首席执行官,原 CEO Daniel Gross 已退出。此前有 Meta 欲收购 SSI 的传闻,Gross 或转 Meta 负责人工智能产品。

机器之心
算法论文8

谢赛宁团队新作:不用提示词精准实现3D画面控制

谢赛宁团队新发布的Blender Fusion框架,结合图形工具 (Blender) 与扩散模型,让视觉合成不再仅依赖文本提示,实现精准画面控制。其核心是对现有技术高效组合,还透露两项训练技巧提升泛化性。

量子位
新闻资讯8

马斯克公布SpaceX火星新计划,迈向多行星生命之路!

马斯克在德州Starbase公布SpaceX火星最新计划,介绍从Starbase发展、星舰生产目标、技术突破到火星城市建设等多方面内容,展示人类成多行星物种的清晰路线,还提及火星时间表等信息。

AGI Hunt
算法论文7

多模态模型具备“物理推理能力”了吗?新基准揭示:表现最好的GPT-o4 mini也远不及人类!

来自多机构研究人员构建PhyX基准测试,评估多模态模型物理推理能力。测试显示,即便表现最佳的GPT - o4 mini准确率仅45.8%,远不及人类的75.6%,且模型在多方面存在结构性缺陷。

量子位
算法论文8

掉像素中介!上海交大让AI边看边想边画,用同一个“大脑”跨模态推理

上海交大等团队提出LatentUM架构,摒弃像素解码中介,在共享语义潜空间跨模态思考。它用MBAQ技术转化视觉特征,设计MoME架构,还能自我反思、规划路线、模拟世界演变,表现出色。

AIGC开放社区
推荐文章8

linux.do:一个被严重低估的中文技术社区,国内懂的人都在偷偷用

本文介绍了中文技术社区 linux.do,它上线两年多,虽访问量已追上老牌社区 V2EX,但很多人不知其存在。其核心围绕 ChatGPT 和大模型,有一手信息、开源协作氛围和活跃管理团队,还给出注册及避坑建议。

AI Reading Hub
开源动态8

告别VAE压缩损耗,南京大学用DiP让扩散模型回归像素空间,实现10倍加速与SOTA级画质

南京大学、腾讯优图实验室和新加坡国立大学发布DiP框架,即将开源。该框架不依赖VAE,仅增0.3%参数量,推理提效10倍,在ImageNet获1.79的FID分数,解决扩散模型在像素空间难兼顾质效的问题。

AIGC开放社区