图像生成」共找到 2394 篇相关文章

新闻资讯7

劈柴哥玩得上头!Nano Banana Pro 真杀疯了,但谷歌没接住用户的付费热情?

谷歌推出新图像生成与编辑模型 Nano Banana Pro,它基于 Gemini 3 Pro,能力提升,获大量好评。不过付费流程繁琐遭吐槽。此外,谷歌 CEO 回应了 AI 泡沫、岗位影响等问题。

AI前线
算法论文8

只看图片就能学会压缩Token!浙大&阿里新框架多轮VQA压缩率90%,精度不掉|CVPR 2026

多轮视觉问答成LVLM推理效率“照妖镜”,现有压缩方法在多轮场景翻车。浙大宋明黎教授团队与阿里联合提出MetaCompress框架,可根据图像生成最优压缩映射,实验验证其效果优,能平衡压缩率与精度。

量子位
算法论文8

DPO与GRPO谁更胜一筹?港中文、北大等联合发布首个系统性对比研究

港中文、北大等团队首次全面对比DPO和GRPO算法在自回归图像生成中的应用,评估其在域内、域外性能,探究奖励模型及扩展策略的影响,为开发高效RL算法提供新思路。

机器之心
算法论文8

1/15成本,实现AI水印新SOTA | 南洋理工大学&A*STAR

给AI生成作品打水印成行业共识,但传统方法有短板。南洋理工大学等机构研究人员提出局部鲁棒图像水印方法MaskMark,成本仅为Meta模型WAM的1/15,在多任务中表现优异。

量子位
产品应用7

Manus突发上新文生图!告别“抽卡”,Agent+深度思考联合创作

Manus深夜官宣支持生成图像,与一般AI绘图工具不同,它能理解画图目的,规划方案后再生成。它可完成如房间装修可视化、饮料瓶设计等任务。目前已开放注册,不过付费价格遭网友吐槽。

量子位
产品应用8

刚刚!谷歌推出Nano Banana官方终极指南:六条保姆级权威提示教程,拿走不谢

谷歌推出Nano Banana(即Gemini 2.5 Flash Image图像模型)官方使用指南,含六条提示词模板及示例,介绍文生图等核心功能,还教你编写有效提示词发挥其潜力。

AI寒武纪
产品应用8

香蕉和GPT Image之外的第3条路:华人15人团队造出AI生图黑马

一支不到15人的华人团队推出AI生图模型Uni-1.1,在Arena.ai榜单冲进全球前三。它将推理和生成融入同一模型,创意可控,价格低,已获阿迪等企业认可,未来将拓展到多模态系统。

量子位
开源动态8

可能是目前效果最好的开源生图模型,混元生图3.0来了

腾讯混元发布并开源原生多模态生图模型混元图像3.0,参数规模80B,是参数量最大的开源生图模型,也是首个开源工业级原生多模态生图模型,效果对标业界头部闭源模型。文中介绍其技术方案、测评效果等。

量子位
算法论文8

何恺明新作:给扩散模型加正则化,无需预训练无需数据增强,超简单实现性能提升

何恺明最新论文研究扩散模型与表征学习的联系,提出Dispersive Loss正则化方法。它无需正样本对,有高通用性、低计算开销等优势,在多模型测试中提升了生成质量,在其他任务也有潜力。

量子位
产品应用7

AI+直播的新玩法! StreamDiffusionV2让创意零延迟

生成模型改变直播行业,但此前模型难保证时间一致性、有延迟等问题。加利福尼亚大学推出StreamDiffusionV2,通过智能调度和缓存机制优化,支持多GPU并行,可灵活调画质和延迟,实现实时直播。

带你学AI