「AI 图像生成」共找到 10853 篇相关文章
谷歌掀桌:深度研究智能体进入自动驾驶时代
4月末谷歌DeepMind推出两款基于Gemini 3.1 Pro的AI研究智能体,标准版重速度,增强版求详尽。Max版在多测试获SOTA得分,能自主研究课题出报告,还可融合数据、生成图表,已开启公开预览。
原生Agent杀入画布!一站式搞定专业创作,全程可控、不抽卡
国内RunningHub平台推出原生AI智能体全能内容创作平台RHTV,它能一站式搞定专业创作,流程可控。实测显示,它能编排短剧、生成商用物料,还内置影视级工具,且依托庞大生态,能力无上限。
ViT一作盛赞:这个中国开源“PS模型”强过Nano Banana
ViT核心作者Lucas Beyer连发三条帖子怒赞通义千问发布的开源模型Qwen—Image—Layered,认为这是图像生成的正确打开方式。该模型可实现PS级拆图自由,支持精细化修改图片元素,核心技术是端到端的扩散模型。
赌自己会失业!田渊栋八人天团狂揽44亿元,杀入「递归进化」赛道
Recursive Superintelligence由八位顶尖AI研究员创立,获GV、英伟达等投资6.5亿美元。他们要让AI自我训练,实现递归自我进化,若成功或使AI研究员岗位消失。此前已有相关成果,产品端Anthropic也在推进AI主动性。
Qwen-lmage-Layered:图片分层 指哪改哪
全新图像生成模型Qwen-lmage-Layered采用自研架构,将图片“拆解”成多个图层,各图层可独立操作。其提出新编辑思路,有RGBA - VAE等亮点,支持灵活迭代分解,能实现精准高效的图像编辑。
刚刚,谷歌摊牌:Genie 3让你1秒「进入」名画,人人可造交互世界!
谷歌新发布Genie 3世界模型,能从文本生成交互式AI空间世界,操控图像和视频。用户可进入《苏格拉底之死》《夜游者》等名画探索,还能利用它训练3D模型,实现沉浸式体验。
北大ChatExcel,获得千万级新投资
北大团队研发的ChatExcel完成天使轮融资,获近千万支持。资金用于产品研发和全球化推广。它是中国首个生成式AI Excel与数据分析智能体,已服务超百万用户,还启动了PreA轮融资。
比GenAI更大的机会
作者认为通用科学计算是比生成式AI更大的市场、机会,英伟达在该领域有统治地位,其竞争对手难以追赶。从市场本质、收入模式、护城河三方面分析,通用科学计算前景更优。
ICCV2025 | One image is all you need,多模态指令数据合成,你只管给图,剩下的交给Oasis
近年来多模态指令数据合成依赖人工设计提示词,成本高。本文提出 Oasis 方法,仅靠图像生成数据,打破传统输入模式,还开源代码库 MM - INF。实验显示其数据多样,能提升 MLLM 性能。
大模型“拼好题”,45K数据撬动18%提升,数学问题拒绝死记硬背 | MathFusion
上海AI Lab等团队提出MathFusion,通过三种“融合策略”生成新的融合数据集MathFusionQA,仅用45K合成指令,在多基准测试中平均准确率提升18.0个百分点,增强模型解决数学问题的能力。