开源动态8
通义Qwen-Image开源,图像文字生成SOTA
量子位
AI 摘要
通义千问开源200亿参数图像生成模型Qwen - Image,实测对提示词理解佳,文字渲染高保真。它有复杂文本渲染和一致性图像编辑能力,在多基准测试达SOTA,中文文本渲染领先。
阅读原文 · 量子位
Qwen新开源,把AI生图里的文字SOTA拉爆了
通义模型家族新开源图像生成模型Qwen - Image,是通义千问系列首个图像生成基础模型。实测其对提示词理解到位,文字渲染高保真。它具备复杂文本渲染、一致性图像编辑能力,在多基准测试达SOTA。

关注公众号
扫码关注
第一时间收到每日精选
相关文章
开源动态8
浙大开源PhyEdit实现单图精准3D物体操作
浙江大学ReLER团队开源的PhyEdit,用3D foundation model明确目标几何,让DiT图像编辑器负责最终渲染。单张图片里物体能移动并形成连续状态,在多项指标表现出色,还具备多种能力,已被ACM MM 2026接收。
新智元
开源动态8
浙大开源PhyEdit,3D图像编辑超Nano Banana Pro
当前图像编辑模型处理三维状态常出错。浙江大学ReLER团队提出并开源PhyEdit,用显式3D几何preview指导图像编辑,还加入深度监督,构建数据集和评测基准,成绩超Nano Banana Pro,且GUI也开源。
量子位
推荐文章8
美图影像研究院:让大众爱上用AI创作
过去两年,AI 生成图片、视频变得容易,但让 AI 理解并按创作者意图创作很难。美图影像研究院过去几年围绕高频创作场景痛点展开研究,11 篇论文被国际顶会接收,成果通过产品落地转化为 AI 影像能力。
机器之心
新闻资讯8
Meta「芒果」生图紧追GPT Image 2
Meta推出图像生成模型Muse Image(代号「芒果」)和视频模型Muse Video预览版。Muse Image在文生图榜单排第二,改变画图方式,能自我修正。它与Muse Spark打通,Muse Video文生视频排第3。不过,其@功能有隐私隐患。
新智元