高分辨率图像」共找到 2262 篇相关文章

算法论文7

SceneGen: 单图像驱动的多资产3D 场景生成

上海交通大学提出SceneGen框架,可从单张场景图像及其对应目标掩码中,同时生成带有几何结构与纹理的多个3D资产。它一次前向传播即可完成生成,在效率与稳健性上优于现有方法,虽有局限但应用潜力大。

带你学AI
推荐文章7

GitHub 已被各类Agent霸榜,今天挑选5个star Agent

文章挑选5个GitHubstar Agent项目。如Hermes Agent是开源自改进AI Agent,有自主技能创建等特性;GitNexus是纯浏览器端代码智能工具;Shannon是白盒AI渗透测试工具等。

GitHubStore
新闻资讯7

谷歌也要「AI抖音」了!新Veo 3.1原生支持竖屏,4K分辨率画质

谷歌Veo 3.1升级,全方位提升视频生成质量,新增竖屏和4K两大特性。它还提升创意、一致性和元素融合能力。谷歌借此进军AI短视频,结合自身优势推动“AI视频竖屏化”趋势。

量子位
算法论文8

庞若鸣还有苹果论文?改善预训练质量数据枯竭困境

苹果基础模型原负责人庞若鸣在 Meta 任职期间,其在苹果参与的价值研究仍不断发表。研究团队针对大模型训练中质量数据枯竭问题,提出 Synthetic Bootstrapped Pretraining (SBP) 预训练流程,提升模型性能。

机器之心
开源动态7

NextStep-1:一次在图像生成上自回归范式的探索

阶跃星辰团队探索自回归图像生成新路径,推出 NextStep-1。它直接在连续视觉空间自回归生成,架构简洁,实现端到端训练。模型有保真生成和编辑能力,Benchmark 表现佳,但也面临稳定性等挑战。

机器之心
新闻资讯8

华为+DeepSeek,推理性能创新!技术报告也公布出来了

华为昇腾在部署超大规模MoE时推理性能创新,全面超越英伟达Hopper架构。其采用‘以数学补物理’方式,还将全面开源。团队从多方面优化,在不同硬件上取得优异性能,本周还将举办技术披露周。

量子位
开源动态8

一句话生图要过时了?开源图像生成Agent进化出「工具编排」

来自多机构的研究团队提出GenEvolve,将开放图像生成建模为「工具编排轨迹」。它配置三类工具,经多轮决策完成生成。通过构建数据集训练,实验显示在多基准上表现出色,已开源模型、代码等。

机器之心
产品应用7

ComposeMe:让发型、服饰与身份随心组合的人体图像生成新范式

人像生成中保持效果清晰真实且自由调整细节是难题,Snap推出ComposeMe,引入‘属性特定图像提示’思路,能灵活组合属性。还建立数据集、提出训练方法,虽有局限,但表现较优。

带你学AI
新闻资讯7

刚刚,OpenAI花470亿大规模回购股票,管火速跳车离场!

OpenAI花70亿美元从员工手中回购股份,交易估值8520亿美元。公司6月已提交IPO申请,但此举或意味着上市推迟。同时,多位管离职,包括伦理负责人,且无继任者。外部竞争加剧,Anthropic势头强劲。

新智元
新闻资讯7

Meta超级智能实验室重组为四个部门,某些管将离开

据《彭博社》报道,Meta 将重组超级智能实验室及相关 AI 部门为四个新部门,某些管预计离职。Meta 此前大力挖角,此次或从依赖内部开发转向集成第三方模型,扎克伯格强调对超级智能的推动。

机器之心