多风格图像」共找到 4502 篇相关文章

新闻资讯8

GPT-6 Astra发布,个基准测试接近满分,“欢迎来到AGI时代”?

当地时间9月3日,OpenAI发布GPT-6 Astra,称其为“最智能、最对齐”的模型。它在测试表现逆天,能力提升显著,还加入新特性。不过价格更高,也带来安全问题。

DeepTech深科技
新闻资讯7

图像模型今夜变天?谷歌刚刚泄露了「Nano Banana Pro」这张王牌

谷歌DeepMind CEO置顶「预告」,传言中的Nano Banana Pro登场在即。它基于Gemini 3.0 Pro级引擎,速度、画质大幅升级,懂界面排版,创作力强,有望让图像模型迈进「专业级时代」。

新智元
开源动态8

智能体编排太繁琐?MASFactory用Vibe Graphing直接「话」出来了

智能体系统编排当前较为繁琐,北京邮电大学开源 MASFactory 框架,提出以图为中心架构和 Vibe Graphing 开发范式,将开发推向自然语言驱动时代,系统评估显示其效果良好。

PaperAgent
开源动态8

Jina-VLM:可在笔记本上跑的语言视觉小模型

Jina AI 发布 2.4B 参数量的视觉语言模型 Jina-VLM,在语言视觉问答任务达 SOTA。它引入注意力池化,连接视觉与语言基座,支持 29 种语言,能高效处理问答等任务,对硬件需求低。

Jina AI
产品应用8

AI Coding新王登场!MiniMax M2.1拿下语言编程SOTA

MiniMax发布旗舰级Coding & Agent模型M2.1,在Multi - SWE - bench榜单中以10B激活参数拿下49.4%成绩,超越竞品成SOTA。它解决模型‘偏科’问题,适配开发工具链,实测在语言编程任务中表现出色。

量子位
7

这输入法200一个月,竟还有10万人排队送钱???

Typeless是一款月订阅费超200元、功能单一却有超10万用户的AI语音键盘。它能转写语音、整理文本、AI润色,支持语言,电脑手机端均可使用。实测其转录准确、整理能力强,但润色功能有局限。

量子位
开源动态8

仅需0.7秒单图像实时3D重建,开源扩散模型

图像3D重建是计算机视觉难题,传统基于回归和生成式方法各有局限。Stability - AI开源SPAR3D模型,融合两种方法规避局限,仅0.7秒完成单图实时3D重建,实验显示性能显著优于其他基线方法。

AIGC开放社区
开源动态8

微软开源2025 ICML获奖框架,终结大模型轮对话严重缺陷

微软开源2025年ICML获奖框架CoLLabLLM,可解决大模型轮对话缺陷。它由四大模块构成,经轮对话模拟和奖励优化模型。在三大基准平台测试显示,能在样任务中高效协作。

AIGC开放社区
产品应用8

刚刚,全球AI生图新王诞生!腾讯混元图像3.0登顶了

LMArena竞技场发布文生图榜单,腾讯混元图像3.0夺冠,超越谷歌、字节和OpenAI等模型。它是原生模态模型,语义理解强,核心技术独特,经阶段训练,效果能与顶尖模型媲美。

量子位
产品应用7

分钟级定位 IO 瓶颈:租户云环境下的智能诊断

随着云上规模扩张,租户云环境下 IO 请求量剧增,IO 问题排查难。阿里云操作系统控制台构建 IO 一键诊断能力,能快速识别问题类型、把握诊断时机、屏蔽复杂关联流程,还介绍了实现原理和案例。

阿里云开发者