自回归图像生成」共找到 2576 篇相关文章

推荐文章7

上海交大/上海AI Lab翟广涛:当评测不再重要,AGI就实现了

上海交通大学教授翟广涛认为完美的AI评测体系等同于通用人工智能。当下评测体系存在数据污染、原子化能力评测局限等问题,他主张回归‘以人为本’,团队提出相关框架和技术路径,目标是训评一体。

机器之心
新闻资讯8

汤道生:腾讯持续加大 AI 投入力度,各项业务全面拥抱 AI

腾讯集团汤道生在 5 月 21 日峰会表示,生成式 AI 可用性质变,腾讯会加大投入,业务全面拥抱 AI。还提出‘四个加速’打造‘好用的 AI’,并介绍混元大模型、智能体等应用成果。

AI前线
产品应用7

能帮你做 Live Photo 了!藏师傅社交卡片 Skill 重磅更新

藏师傅社交卡片 Skill 重磅更新,新增 Live Photo 生成和编辑能力,可处理产品录屏等素材。介绍了能做的卡片类型、使用方法、适用场景,还提及制作细节及 Live Photo 的价值和安装更新方式。

歸藏的AI工具箱
开源动态7

Moonshot AI发布Kimi Linear技术报告,采用混合线形注意力架构

Moonshot AI在Hugging Face发布Kimi Linear技术报告,该48B参数模型采用混合线性注意力架构,称超越传统全注意力机制。官方数据体现其优势,模型已开源,社区反应不一,MiniMax则回归全注意力架构。

AI工程化
算法论文8

一键开关灯!谷歌用扩散模型,将电影级光影控制玩到极致

Google推出LightLab项目,可从单张图像精准控制光影,解决传统光影控制难题。其通过特殊数据集微调扩散模型,让模型学会控制光照,还介绍了方法、后处理流程等,实验显示表现优,有多种应用。

机器之心
新闻资讯7

The Batch: 973|Claude 的水印如何运作

Anthropic将在2026年8月2日后发布的Claude模型全球部署肉眼不可见、机器可读的水印,用于表明文本和图像由其生成。该技术基于Google的SynthID - Text,不过此公告引发广泛争议。

DeeplearningAI
开源动态7

Claude水印已被破解,斩获11k Star!但会被拒绝安装

Anthropic为Claude生成文本添加隐藏水印,引发争议。很快有开源项目可去除Claude、Gemini、OpenAI水印,获11k Star,但Claude拒绝安装。反对与支持水印者观点不一,双方展开猫鼠游戏。

机器之心
算法论文8

让扩散模型「可解释」不再降质,开启图片编辑新思路

过去三年扩散模型席卷图像生成领域,但可解释性研究是‘黑箱’,且现有尝试常致性能下降。香港中文大学与上海人工智能实验室团队提出TIDE框架,可解释且不降质,还带来新图像编辑方式。

机器之心
新闻资讯8

马斯克抢先谷歌一步放大招,Grok 4.1登顶LMArena,创意写作直逼GPT-5.1

谷歌Gemini 3将上线消息正热时,马斯克旗下xAI的Grok 4.1凌晨上线。它有两个“形态”,免费开放且有APP版。在LMArena测试中表现优异,事实稳定性、情商、创意写作等能力提升,实测也有不错表现。

InfoQ
新闻资讯8

何恺明新身份:谷歌DeepMind杰出科学家

网友爆料何恺明加入谷歌,经确认他以兼职形式成为谷歌DeepMind杰出科学家。可根据其近期研究推测研究方向,他还探讨生成模型能否走向端到端。何恺明履历辉煌,成果众多。

机器之心