单图像3D重建」共找到 1059 篇相关文章

开源动态8

Google这个1.5w star 项目牛皮,99%准确率!

Google安全团队开源AI文件类型检测工具Magika,抛弃固定规则匹配,用深度学习精准识别文件真实类型。它内置轻量模型,CPU毫秒级推理,支持200+格式,准确率约99%,已大规模落地。

开源先锋
开源动态8

腾讯混元开源AI绘画新框架:24维度对齐人类意图,让AI读懂复杂指令

腾讯混元团队开源PromptEnhancer框架,通过“思维链提示重写”提升AI绘画文本 - 图像对齐精度,复杂场景准确率提升17%以上。还开源高质量基准测试数据集,为研究提供支撑。

量子位
产品应用8

刚刚!谷歌推出Nano Banana官方终极指南:六条保姆级权威提示教程,拿走不谢

谷歌推出Nano Banana(即Gemini 2.5 Flash Image图像模型)官方使用指南,含六条提示词模板及示例,介绍文生图等核心功能,还教你编写有效提示词发挥其潜力。

AI寒武纪
新闻资讯7

马斯克亲口承认xAI「建废了」,急挖Cursor大牛反击Claude

xAI重组引发创始高管动荡,马斯克承认其一开始就没搭对,不得不推倒重建。2026年1月起大规模裁员,Macrohard和Grok Imagine受冲击大。前Cursor两位核心高管入职,或助力编程方向发展。

新智元
算法论文8

CVPR 2026 | EmoStyle:情感也能“风格化”?深大VCC带你见证魔法!

EmoStyle由深圳大学可视计算研究中心黄惠教授课题组完成。它解决图像情感风格化两大挑战,提出有效方法、构建数据集、设计模块。实验显示其平衡情感与内容,还能扩展到文生图。

机器之心
新闻资讯7

视频版Nano Banana来了!内置Gemini世界知识;原版香蕉出图仅需4秒

谷歌开放Gemini Omni Flash API,将多模态推理与视频生成编辑结合,有4项关键能力,也有局限。Nano Banana 2 Lite出图快且便宜。二者串联使用,图像生成与视频创作可无缝衔接。

量子位
新闻资讯8

史上最狠春节!阿里千问豪掷30亿,加入AI大战

阿里千问官宣“春节请客计划”,自掏30亿通过免请全国人民吃喝玩乐。其依托阿里Qwen模型和丰富生态,介入生活场景能力强,此次活动或让AI从工具成消费决策默认选择。

量子位
开源动态8

清华团队:1.5B 模型新基线!用「最笨」的 RL 配方达到顶尖性能

清华团队用两个 1.5B 模型证明,用最基础的 RL 配方可达到小模型数学推理能力 SOTA。阶段训练加固定超参数实现 SOTA 性能且省一半算力,训练曲线还很平滑。

机器之心
开源动态7

SGLang|SGLang Diffusion

来自SGLang开源社区的Yichi介绍SGLang Diffusion,它是面向图像与视频生成的全开源扩散模型推理引擎。基于SGLang机制将能力迁移到扩散模型推理,能显著提速工作流,视频展示了多种功能。

GiantPandaLLM
开源动态8

GAIA 榜首,杀疯了!高并发、多任务京东开源的JoyAgent秒杀行业巨头

本公众号关注AI前沿技术,分享实战案例与课程。京东开源轻量化通用多智能体产品JoyAgent - JDGenie,可挂载新场景功能,在GAIA榜准确率超行业知名产品,还介绍了其架构特点与创新点。

CourseAI