多风格图像」共找到 4493 篇相关文章

新闻资讯8

ICIG 2025:共话图像发展新坐标

2025年10月31日至11月2日,第十三届国际图象图形学学术会议(ICIG 2025)在徐州举行,700余人参会。大会展示前沿成果,设场论坛与赛事,专家认为其为领域发展注入新动力,巩固中国学术交流地位。

AI科技评论
开源动态8

字节开源高效解析文档图像的新型模态模型Dolphin,快速将复杂的文档图像转化为结构化数据。

字节开源新型模态模型Dolphin,采用“先分析后解析”范式,能将复杂文档图像转化为结构化数据。它有卓越性能和种特性,还提供安装、推理使用指南。

GitHubStore
新闻资讯8

再封神!OpenAI掀翻AI图像生成,极度逼真,立刻商用

网传OpenAI的GPT-image-2正在灰度测试,韩国网友测试后称其生成图像可‘立刻商用’。它深度融合GPT大语言模型,生成照片更逼真,强化了提示遵循和场景理解能力,让AI图像生成进入‘实用时代’。

AIGC开放社区
算法论文7

BLIP3-o统一图像生成与理解,模态融合趋势显现

BLIP3 - o致力于统一图像理解和生成、提升生成质量和效率。它融合自回归与扩散模型,采用CLIP + Flow Matching架构等技术亮点。经训练,在图像理解和生成任务表现出色,指令微调效果显著。

CourseAI
产品应用8

AI 代码审查再进化:AutoDev 智能体协作架构深度解析

现代软件开发中,代码审查存在信息割裂、人工效率低等痛点。AutoDev 借助智能体协作与信息聚合,实现从分析到修复的闭环智能流程,还构建 Agent 协作体系,未来将集成更能力。

phodal
算法论文8

都在卷「让大模型循环几遍」,这个7B模型LoopCoder v2说:循环 1 次就够了

当下推理模型流行在测试时循环,以打磨答案。但新研究发现,7B模型LoopCoder v2只循环1次(共2次),就能大幅提升性能,继续增加循环次数,性能反而下降。研究还分析了收益与成本,给出选择循环次数的诊断方法。

机器之心
产品应用7

与Banana Pro过过招,国产Libcom图像合成工作台开启Labubu漫游记

2025年AIGC热度再创新高,通用图像编辑大模型虽功能强大,但在细分领域有不足。上海交通大学牛力团队推出并升级了Libcom图像合成工作台,与Nano Banana Pro对比,其在图像合成上表现更稳定。

机器之心
产品应用7

Harness Monitor:当个 Agent 同时写代码时,如何看住质量

作者在有了 OpenAI 赞助的 Codex Pro 后,让个 Agent 同时在一个代码库工作。他开发的 Harness Monitor 从 Git 视角出发,解决 Agent 写代码时的质量问题,涉及观察、治理等方面能力。

phodal
推荐文章7

智能体自主规划模式性能提升:五大精准策略详解

本文基于智能体React模式实践,剖析自主规划架构挑战,如工具调用延迟等。提出五大优化策略,像用流式XML替代FunctionCall、合理压缩上下文等,还介绍创意加速器AI绘画创作功能,为智能体规划模式提供借鉴。

阿里云开发者
产品应用8

Nano-Banana 核心团队分享:文字渲染能力才是图像模型的关键指标

谷歌新发布的图像生成与编辑模型Gemini 2.5 Flash Image(Nano - Banana)热度超Grok视频生成。文章通过团队访谈,介绍其图像创作新方式、文字渲染代理指标、交错生成能力等,还对比了与Imagen差异,展望AI终极形态。

Founder Park