图像超分」共找到 2992 篇相关文章

产品应用8

腾讯用AI把美术管线重新做了一遍,混元3D Studio架构曝光

腾讯推出专业级AI工作台混元3D Studio,可覆盖3D资产生产全流程,让生产周期大幅缩短。它有组件拆、可控图像生成等七大核心技术模块,各模块对应关键阶段,实现无缝衔接与自动化。

量子位
开源动态8

百度Qianfan-VL开源,纯国产自研昆仑芯跑出世界一流

百度开源全新视觉理解模型Qianfan-VL,有3B、8B和70B三个版本,在昆仑芯P800芯片上训练。该模型多模态能力强,OCR和教育场景表现突出,跑国际主流模型。芯片功耗低、架构优,模型训练方法创新。

AIGC开放社区
推荐文章8

API7.ai创始人温铭:烧了几百亿Token,我用AI重写了生产级网关,总结出6条经验

API7.ai创始人温铭享用AI重写生产级网关经验。他认为AI编码能力资深工程师,瓶颈在人。还介绍在公司‘禁手写代码’的情况,以及AI代码审查、使用阶段等内容,最后说明重写AI网关AISIX的原因。

InfoQ
开源动态8

13小时不眠不休,300个身狂敲代码!开源第一易主了

4月20日深夜,Kimi K2.6出道即开源,展示了强大的「全栈交付」能力,跑GPT - 5.4等。它能完成多类型官网制作,300个Agent协作能力强,还能复刻高盛研报、交付三件套,其Claw群组开启小范围测试。

新智元
新闻资讯8

黄仁勋2025都在投啥?出手50次,32家公司覆盖产业链闭环

2025年前三季度,英伟达参与50笔AI风投去年全年。投资覆盖基础设施、模型厂商、应用等领域。其AI俱乐部有32家公司,三档。英伟达鲜少领投,黄仁勋不信AI有泡沫,投资能锁定硬件订单。

量子位
算法论文8

解决扩散模型过拟合的创新框架T-LoRA

预训练大型文本到图像扩散模型定制化时,样本有限易致过拟合。AIRI和HSE大学团队提出T - LoRA框架,动态调整训练能力、用正交初始化,实验显示其在单图像和多图像任务表现优,用户更偏好其生成图像

AIGC开放社区
新闻资讯7

Karpathy 评 DeepSeek-OCR:词器必须消失!马斯克:光子才是 AI 的终极语言

Andrej Karpathy 发长文讨论 DeepSeek - OCR 论文,提出图像输入比文本更高效,还表达对词器的厌恶,认为其必须消失。马斯克称 AI 主要交互将是视觉。开发者享实践经验,也有人提出质疑。

AGI Hunt
产品应用7

刚刚,OpenAI推出全新ChatGPT Images,奥特曼亮出腹肌搞宣传

OpenAI推出全新ChatGPT Images,由新旗舰图像生成模型驱动,特性有精准编辑、保留细节等,图像生成速度提升4倍。该功能今日向多数用户开放,价格降20%,旨在让图像生成更简单。

机器之心
新闻资讯7

英伟达半数打工人身家过亿!难怪离职率低

一份调查显示英伟达约半数员工身家2500万美元,78%百万美元。管理层富翁数字更惊人,公司离职率仅3.7%。其造富源于员工持股和限制性股票计划,近期又宣布芯片量产。

量子位
算法论文8

NIPS2025|小红书智创AIGC团队提出布局控制生成新算法InstanceAssemble

当下文本生成图像扩散模型有进展,但现有布局到图像生成方法在复杂场景表现不佳。小红书智创AIGC团队提出InstanceAssemble框架,从架构和评测应对难题,实现复杂布局下精确图像生成,有广阔应用潜力。

机器之心