高分辨率」共找到 1890 篇相关文章

产品应用8

谷歌Nano Banana Pro上线,深度结合Gemini 3,这下生成世界了

谷歌最新图像生成模型Nano Banana Pro(Gemini 3 Pro Image)上线,结合Gemini 3 Pro强大推理与知识,在控制力、文字渲染和世界知识方面升级,能生成高分辨率、一致性强图像,还支持创意操控、多语言文本生成等,多产品将上线。

机器之心
新闻资讯8

继AlphaFold之后,DeepMind再放“大招”:AlphaGenome直击疾病根源

谷歌DeepMind推出AI模型AlphaGenome,可预测DNA序列微小变化对基因调控的影响,已向非商业研究领域开放。它能处理长序列、输出高分辨率结果,有四大优势,在多领域有研究潜力,但也存在局限。

AI寒武纪
算法论文8

CVPR 2026 | 从视觉Token内在变化量出发,实现VLM无损加速1.87倍

随着高分辨率图像与长视频处理需求增长,大型视觉语言模型推理效率成瓶颈。V²Drop从视觉Token内在变化量出发,采用多阶段渐进式剪枝策略,实现无损加速,在图像和视频理解场景表现卓越。

机器之心
算法论文8

刷新3D生成上限!一键生成精细到毛发的3D资产

质量3D生成需求增长背景下,现有3D生成框架在兼顾效率和质量上有瓶颈。南洋理工大学等提出Ultra3D框架,采用coarse - to - fine两阶段流程,用Part Attention机制提升效率,支持高分辨率输出。

量子位
算法论文8

视听分离SOTA提速6倍!清华发布首个6M性能模型|ICLR'26

清华大学团队推出Dolphin模型,仅用6M参数,通过离散化视觉编码和热扩散注意力机制,实现单次推理精准分离语音,速度提升6倍以上,在多项基准测试中刷新纪录,为端侧设备部署开辟新路。

新智元
算法论文8

ICCV 2025 | ECD:质量合成图表数据集,提升开源MLLM图表理解能力

科研等领域图表是信息核心载体,先进开源MLLMs在难度图表理解测试准确率低。本文提出ECD数据集,规模大、质量、风格多样,还设计合成流水线与评测基准ECDBench,为开源MLLM提供支持。

机器之心
7

苹果一口咬死AI不会思考!OpenAI前管直接开怼:AGI已来,别再酸了

苹果论文《思考的错觉》挑战AI推理能力基本假设,引发争议。OpenAI前研究主管则称AGI时代已近。多项研究测试推理模型,指出其有进步也有瓶颈,未来或需换思路,评估方式也待完善。

新智元
算法论文8

斯坦福与Adobe新研究,模仿蒸馏技术轻松让200亿参数图像生成质量大模型

斯坦福大学和Adobe研究院联手,用pi - Flow技术让200亿参数文本到图像大模型4步内生成质量、多样性图片。此前少步生成有质量和多样性问题,他们推出GMFlow和pi - Flow解决难题,LakonLab是其背后工程支撑。

AIGC开放社区
算法论文8

BookRAG:专治各种「层次化复杂」文档

BookRAG专为处理层次化复杂文档而生。传统RAG有两大盲区,而BookRAG在多模态长文档基准上刷新SOTA。它采用BookIndex×Agent - based Retrieval技术方案,效率、可扩展性强,兼顾精度、召回、低成本。

PaperAgent
7

AI本该助力新人,为何反而让手更强?

人们曾认为AI能让初级程序员创造质量代码,减少对级工程师依赖。但现实是‘手 + AI’才是有效组合。文章分析AI优劣,指出其让手更强,还给出使用建议,强调要校准对AI的期待。

宝玉AI