「AI图像创作」共找到 10069 篇相关文章

算法论文8

加速近5倍!北大与字节团队提出BranchGRPO,用「树形分叉 + 剪枝」重塑扩散模型对齐

北京大学与字节团队提出 BranchGRPO 新型树形强化学习方法,通过在扩散反演中引入分叉与剪枝,解决扩散/流匹配模型人类偏好对齐难题。该方法在图像与视频生成任务中表现优异,迭代时间最高近 5 倍加速。

机器之心
算法论文8

妙笔生维:线稿驱动的三维场景视频自由编辑

研究人员提出基于线稿的三维场景视频编辑方法Sketch3DVE,相关论文发表于SIGGRAPH 2025。它能让用户基于线稿重塑三维场景视频,解决了现有方法个性化不足、真实感差等问题,支持单目图像三维视频合成和二次编辑。

机器之心
推荐文章7

Manus首次揭秘:Agent的关键在上下文工程

Agent成大模型主战场,构建方法待探索。Manus发blog揭秘,认为成功的AI Agent依赖上下文工程。团队选此实现快速迭代,虽实践不易,但总结出围绕KV缓存设计等关键点,其经验影响Agent表现。

AI寒武纪
产品应用8

对普通人最有用的一次!藏师傅教你用FLUX Kontext解决一切图片问题

黑森林工作室发布生成式流匹配模型 FLUX Kontext,它能编辑图片且不影响未编辑区域,支持多图参考生成新图像。可用于去水印、修复照片、修改海报、生成商品展示图等,还能美颜美体,替代 PS 等工具。

歸藏的AI工具箱
新闻资讯7

4万多名作者挤破头,CVPR 2025官方揭秘三大爆款主题, 你卷对方向了吗?

CVPR 2025 官方根据 4 万多名作者 13008 份投稿,总结出计算机视觉热门的三大方向,即基于多视角与传感器的 3D 技术、图像与视频合成、多模态学习(视觉、语言和推理),并介绍了各方向热门原因。

机器之心
推荐文章7

Mastra 还是 LangGraph.js?选型先看三条断层线

2026 年上半年,TypeScript 团队做 AI Agent 常面临 Mastra 和 LangGraph.js 选型难题。二者功能清单趋同,但工程哲学不同。文章从语言原生与跨语言移植、缩到零的 serverless 与常驻的持久化、完整工具箱与自由原语三条断层线分析选型依据。

AI Reading Hub
推荐文章9

“数据比模型重要”成了共识,接下来拼什么?

本文为数势科技创始人黎科峰记录上海闭门行业圆桌内容,不同领域从业者一致认为,大模型已非企业AI胜负手,数据与语义层才是核心瓶颈,共识形成后行业进入深度竞争阶段。

InfoQ
新闻资讯8

GPT-6 Sol和Opus 5.2同时灰测!奥特曼阿莫迪周末刚喊刹车,一上班就踩油门

本文爆料OpenAI和Anthropic同步灰度测试新一代大模型GPT-6 Sol和Claude Opus 5.2,对比了模型性能提升,同时提到OpenAI GPT-5.5即将退役,带来AI大模型领域最新前沿动态。

量子位
新闻资讯7

深度 | MLCC涨价真相:不再是手机件,而是算力基建

2026年7月,MLCC行业处于AI算力驱动的涨价周期。供需双重驱动使其进入新景气周期,正从“周期品”变“成长品”。国产厂商微容科技成长性亮眼,“三轮驱动”抗周期,有望在国产替代中突围。

芯师爷
新闻资讯7

奥特曼马斯克豪言:我们已进入奇点!AGI加速窗口已至

新智元报道,奥特曼和马斯克都认为奇点已至,当下处于AGI加速窗口。OpenAI曾靠资源猛追让Codex逆袭。但AI发展也引发担忧,如人类能否保持理智、安全对齐进展不明等。

新智元