「图像生成模型」共找到 8880 篇相关文章

产品应用7

AI 编程工具在大型企业“遇冷”?网易 CodeWave 升级研发模式,不只关注“代码生成”

近些年,自然语言编程成 AI 编程产品主流。C 端通用 AI coding 工具表现出色,但国内企业级市场 AI 技术渗透率低。网易 CodeWave 专注企业级场景,指出通用工具痛点,提出‘可控的 AI coding’定位并升级能力,未来还将推新开发模式。

AI前线
开源动态8

开源AI教育视频生成神器,3Blue1Brown风教学动画一键搞定!

新加坡国立大学Show Lab团队开源Code2Video,能让代码变高质量教育视频,逻辑是用代码驱动视觉效果。它有智能解析等特性,可解决传统教学视频形式单一等问题,应用场景广泛。

开源星探
算法论文8

SFT远不如RL?永不过时的剃刀原则打开「终身学习」大模型训练的大门

现代AI系统学习新任务时会灾难性遗忘旧知识,限制其持续学习能力。麻省理工学院研究者对比SFT和RL后发现,相同性能下RL更不易遗忘,提出遗忘定律,解释了RL优势源于其on - policy特性。

机器之心
开源动态8

一张图0.1秒生成上半身3D化身!清华IDEA新框架入选ICCV 2025

清华和IDEA研究人员提出新框架GUAVA,可0.1秒从单图创建上半身3D化身。它解决了现有方法在ID一致性、效率等方面的局限,实验显示其在渲染质量和效率上优于现有2D和3D方法,代码已开源。

量子位
新闻资讯7

4比0横扫Grok 4,o3强势夺冠,首届大模型对抗赛结果出炉

备受AI圈关注的首届谷歌Kaggle AI Chess大赛落幕。o3以4 - 0横扫Grok 4夺冠,Gemini 2.5 Pro 3.5 - 0.5击败o4 - mini获季军。此前Grok 4被视为夺冠热门,决赛却频频失误。

机器之心
新闻资讯7

好玩!AI“穿越”新玩法火了:根据12岁照片生成23岁的你

AI“穿越”新玩法火了,外国网友让ChatGPT根据12岁照片推测23岁样子还挺准。很多人参与,还有新奇玩法。作者用不同名人照片测试ChatGPT、抖音小程序和豆包,结果各有偏差,但玩法有趣。

量子位
算法论文8

感知错误率降低30.5%:隐式感知损失让模型主动“睁大眼睛” | UIUC&阿里通义

伊利诺伊大学香槟分校与阿里通义实验室推出多模态推理强化学习算法PAPO。它用隐式感知损失设计,解决感知与推理脱节问题,在多基准测试中表现优,但有KL_prcp Hacking现象。

量子位
推荐文章7

AI大模型浪潮下的认知重构:从一个数据老兵的转型思考

作者作为数据老兵,分享接触 ChatGPT 后的转型思考。指出 AI 使编程、数据分析师岗位巨变,填鸭式教育不再适用。强调认知结构是护城河,还探讨了 ETL、数据建模及 AI 原生产品变化。

InfoQ
开源动态8

通义实验室新研究:大模型自己「扮演」搜索引擎,提升推理能力无需搜索API

阿里通义实验室开源ZeroSearch,提供无需与真实搜索引擎交互的强化学习框架。它用模拟搜索环境和渐进式抗噪训练,让LLM自给自足,节省API成本,在多问答数据集表现优,为智能化检索提供新思路。

量子位
产品应用7

用AI把一段视频变成可视化网页,Google的新模型又卷飞了。

Google更新Gemini 2.5 Pro至05 - 06版。此版代码能力在WebDev Arena盲测登顶,超Claude 3.7 Sonnet;还提升视频理解,可将视频转为可视化网页,虽有产品打磨问题,但进步值得肯定。

数字生命卡兹克