图像超分」共找到 2979 篇相关文章

产品应用8

“图片秒生”,腾讯混元图像2.0模型正式发布,主打速度和真实感

5月16日,腾讯发布混元图像2.0模型,率先实现实时生图,生图速度快、质量高,能避免‘AI味’。在GenEval基准上准确率95%,还发布实时绘画板功能,后续将推原生多模态模型。

AI科技大本营
算法论文8

颜水成领衔,给AI段位!100款多模态模型,无人达到L5

十所顶尖高校联合发布General - Level评估框架和General - Bench基准数据集,用五级类制明确多模态通才模型能力标准。评估100款模型,发现多数在L2 - L3,无L5模型,揭示当前模型不足。

新智元
开源动态8

一个模型了DeepSeek R1、V3,参数671B,成本不到350万美元

Deep Cogito 是旧金山 AI 初创公司,开源四款混合推理模型。最大 671B MoE 模型性能 DeepSeek v3 等,推理链比 DeepSeek R1 短 60%,训练成本不到 350 万美元。核心方法是迭代蒸馏与增强。

机器之心
新闻资讯7

第一,实战拉胯!GPT Image 1.5被骂惨,奥特曼这波悬了

OpenAI推出新一代旗舰图像模型GPT Image 1.5,生图能力强,免费用户可上手,开发者能调用API。它在跑榜单成绩优异,但网友实测发现是‘高低能’,引发吐槽。此外,其API价格降20%,此次更新是回击谷歌。

新智元
新闻资讯8

GAIR 2025 世界模型论坛:从通用感知到视频、物理世界模型的百家争鸣

第八届GAIR全球人工智能与机器人大会世界模型论坛上,五位青年学者围绕世界模型展开精彩演讲,话题涵盖通用感知、三维技术等。他们的研究为世界模型领域带来不同启发,目前该领域研究尚处起步阶段,共识未形成。

AI科技评论
算法论文8

ACM MM 2025 Oral | 新加坡国立大学提出FractalForensics,基于形水印的主动深度伪造检测与定位

近些年来,深度伪造主动防御受关注,但现有方法有鲁棒性不稳定等问题。新加坡国立大学等团队提出 FractalForensics 方法,基于形水印实现主动深度伪造检测与定位,实验效果良好。

机器之心
算法论文8

突破高辨率图像推理瓶颈,复旦联合南洋理工提出基于视觉Grounding的多轮强化学习框架MGPO

先进多模态大模型处理高辨率图像有瓶颈,复旦和南洋理工研究者提出基于视觉Grounding的多轮强化学习方法MGPO,能让模型精准推理,还可使模型从答案反馈中涌现视觉定位能力,避免依赖昂贵标注。

机器之心
算法论文8

ICLR 2026|原生多模态推理新范式ThinkMorph ,让文字与图像在统一架构中共同演化

NUS、ZJU 等联合提出「ThinkMorph」,主张文字与图像在统一架构「原生协作」。仅用 2.4 万条数据微调 7B 统一模型,视觉推理平均提升 34.74%,多项任务比肩或 GPT - 4o 和 Gemini 2.5 Flash,还涌现新能力。

机器之心
新闻资讯8

刚刚,小米一口气发布三颗自研芯片!玄戒O3安兔兔跑522万,安卓首破500万

小米玄戒技术沟通会上,负责人朱丹介绍三款芯片。主推AI旗舰SoC玄戒O3,安兔兔跑522万,下月将在小米18 Fold首发。还介绍了玄戒O100和玄戒D100,预计明年商用。

量子位
开源动态7

OCR又出宠OpenDoc,速度MinerU6倍

复旦开源的OpenOCR是面向通用OCR任务的开源平台,其OpenDoc是轻量文档解析系统。它采用Pipeline模式,两阶段解析不易放大误差。UniRec - 0.1B有独特架构与层监督训练等创新技术。

CourseAI