多风格图像」共找到 4501 篇相关文章

产品应用7

谷歌Gemini火力全开!实测:原生图像生成新升级确实强

谷歌Gemini原生图像生成功能升级,图像质量更好、文本渲染更准、生成速度更快。可融合图片元素、实时编辑等,能免费试玩,开发者可集成API。实测表现惊艳,也有翻车情况,还能搭配Gemini 2.5 Pro。

量子位
开源动态7

AI图像水印失守!开源工具5分钟内抹除所有水印

一款名为UnMarker的去水印技术,能在5分钟内去除市面上几乎所有AI图像水印,谷歌HiDDeN已被完全破解,SynthID被攻破79%。它保持较高图像质量,已在GitHub开源,凭消费级显卡可本地部署。

量子位
开源动态8

阿里开源AgentScope 1.0,智能体从开发到部署一条龙服务

大语言模型发展下,智能体系统开发面临诸难题。阿里通义实验室开源AgentScope 1.0框架,以开发者为核心,有三层解耦架构,模块化设计,还解决安全和管理问题,在工程化特性上优势明显。

AIGC开放社区
产品应用7

大规模工程支撑场景下的智能体系统设计:Grab 实践案例

Grab分析数据仓库(ADW)团队推出智能体AI系统,处理数据仓库故障排查等工程请求,减少重复性运维。团队搭建智能体架构,整合工具生态,考虑安全治理,解决上下文管理挑战,提升工作效率。

InfoQ
产品应用7

3 个 Multi-Agent 系统,把 GPTBots 的智能体协作玩明白了!

文章介绍如何在GPTBots平台玩转智能体系统,阐述智能体协作优势、架构及三种协作模式,通过旅游规划、辩论对抗、商业决策三个案例展示协作模式应用,还给出总结与进阶建议。

PaperAgent
开源动态8

谷歌AI Agent刚开源!任务智能体+MCP+谷歌搜索,狂揽9000颗星

今天凌晨,谷歌在官网开源AI Agent框架Gemini CLI,将Gemini大模型融入终端。它能调用视频和图像模型,集成MCP、谷歌搜索等功能,还集成超强编码助手,刚开源就在Github超9000颗星。

AIGC开放社区
开源动态8

ICML 2025 Spotlight | 用傅里叶分解探讨图像对抗扰动,代码已开源

文章聚焦图像对抗净化,现有基于扩散模型策略在时域难解耦干净像素与扰动,损害图像语义。作者从频域研究,用傅里叶分解,发现扰动倾向破坏高频谱,提出注入低频信息,效果显著,论文与代码已开源。

机器之心
开源动态8

少 61% Token、10倍成功率,这个终端 AI 编程代理火了!

现在数AI编程工具问题,而在Github上火爆的`oh-my-pi`是运行在终端的AI编程代理,有哈希锚定编辑等实用功能,支持模型,经基准测试效果好,还能解决实际开发痛点。

开源先锋
算法论文8

纯靠“脑补”图像,大模型推理准确率狂飙80%丨剑桥谷歌新研究

剑桥、伦敦大学学院和谷歌团队推出基于强化学习的视觉规划(VPRL)新范式,纯靠图像推理。新框架利用GRPO后训练,准确率达80%,超文本推理至少40%,代码已开源。

量子位
产品应用8

顶级邪修再战 Nano Banana Pro ,超玩法,太猛了这玩意!

谷歌发布 Nano Banana Pro 模型,将图片模型能力推向顶峰,支持中文。它能生成准确视觉内容、语言文本,可混合元素,支持分辨率。经测试,其各方面表现出色,应用场景丰富,版权限制宽松,三方应用和谷歌官方均可使用。

歸藏的AI工具箱