图像驱动」共找到 1037 篇相关文章

算法论文8

一张照片,一个3D「你」:计算所等提出HumanLift,实现高保真数字人重建

中国科学院计算技术研究所等机构研究人员提出 HumanLift 技术,基于单张参考图像重建高斯网数字人全身。该技术融合三维视频扩散模型和人脸增强,仅需单张人体图片就能重建高逼真三维数字人。

机器之心
算法论文8

NeurIPS 2025 Spotlight | 条件表征学习:一步对齐表征与准则

文章指出传统表征学习处理图片和商品信息时存在局限,针对性有监督训练成本高,多模态大模型使用成本也需考虑。为此提出即插即用的条件表征学习方法 CRL,实验显示其在下游任务表现优异。

机器之心
产品应用7

让YOLO飞起来:从CPU到GPU的配置指南

文章指出默认安装的YOLO用CPU计算,处理大量图像或实时检测任务效率低。详细介绍将YOLO从CPU模式切换到GPU模式的步骤,对比性能,还给出常见问题解决办法,能显著提升运行效率。

机器学习AI算法工程
新闻资讯8

AI如何成为生产力?2025云栖大会将给出答案 | 甲子光年

2025年全球AI产业面临转折,从理想回归现实,AI落地遇难题。9月24 - 26日云栖大会将召开,围绕前沿话题探讨,展示云与AI技术及产品,以‘云智一体·碳硅共生’呈现AI演进与落地。

甲子光年
产品应用7

秒级集群翻转、分钟级IDC故障止损 | 同程大规模Elasticsearch平台架构设计与实践

在数据驱动时代,同程旅行核心业务依赖Elasticsearch,随着集群规模扩大,面临对用户、运维、平台要求高的挑战。本文分享同程ES平台架构设计、解决方案与实践成果,还展望借助大模型提升智能化水平。

InfoQ
推荐文章8

对「学习」的一切认知都错了

曾被认为不可能的超大模型如今成功驱动ChatGPT等,改变了对学习的理解。彩票假说解释其成功:大网络有中奖子网,能提供更多找简单解的机会,调和了经验与经典理论。

AI寒武纪
新闻资讯8

刚刚,谷歌摊牌:Genie 3让你1秒「进入」名画,人人可造交互世界!

谷歌新发布Genie 3世界模型,能从文本生成交互式AI空间世界,操控图像和视频。用户可进入《苏格拉底之死》《夜游者》等名画探索,还能利用它训练3D模型,实现沉浸式体验。

新智元
新闻资讯7

The Information:揭秘 OpenAI GPT-5 崎岖的研发之路

The Information揭秘OpenAI GPT - 5研发困境,今年OpenAI遇技术难题,o3等模型研发受阻,内部有分歧。不过GPT - 5在编程等方面有提升,虽难与早期飞跃相比,但改进仍有价值,公司还在开发‘通用验证器’。

宝玉AI
算法论文8

研究者尝试揭示扩散模型创造力的起源

斯坦福大学研究人员 Mason Kamb 与 Surya Ganguli 在论文中提出解释扩散模型创造力的机制,指出其创造力是去噪生成图像时的确定性结果,还识别出关键偏置,搭建 ELS 机模型并验证其准确性。

InfoQ
新闻资讯7

OpenAI即将发布:开源模型和浏览器

OpenAI将发布AI驱动的网页浏览器挑战谷歌Chrome,或集成代理Operator实现智能网络体验。还准备下周四发布类似o3 mini的开源模型,不再是微软Azure独家。谷歌也可能很快发布Gemini 3。

AI寒武纪