混元图像3.0」共找到 3080 篇相关文章

新闻资讯7

跳出英伟达生态:OpenAI 发布新编程模型 GPT-5.3-Codex-Spark,速度达 1000 token每秒

OpenAI 发布新编程模型 GPT-5.3-Codex-Spark,跑在 Cerebras 晶圆级芯片上,速度达每秒超 1000 个 token,比传统 GPU 推理快约 15 倍,这是其跳出英伟达生态的里程碑。

AGI Hunt
算法论文8

推理时间减少70%!前馈3DGS「压缩神器」来了,浙大Monash联合出品

在AR、VR等领域,3DGS是新视角合成(NVS)领域备受关注的技术方案。现有前馈3DGS模型存在编码器容量有限等问题,ZIP Lab和Monash团队引入信息瓶颈原理,推出轻量级模块ZPressor,有效解决信息过载难题。

量子位
新闻资讯8

深度讨论 Gemini 3 :Google 王者回归,LLM 新一轮排位赛猜想|Best Ideas

近期,OpenAI、Google、Anthropic 先后发布新模型,引发大模型竞赛。本文聚焦 Google 发布的 Gemini 3,从算力、数据、架构等维度剖析其强大原因,探讨大模型竞争新格局,还涉及多模态、硬件、商业化及产品形态等方面。

海外独角兽
算法论文8

一句话生成无限逼真3D场景!匹兹堡大学新作直击VLM空间推理软肋丨CVPR'26

VLM在3D空间推理上表现不佳,且缺乏合适测试基准。匹兹堡大学团队提出InfiniBench框架,用LLM Agent迭代优化和聚类策略,可按需生成3D场景,还能精准定位大模型空间推理缺陷。

量子位
开源动态8

Transformer开始构建三维世界:开源模型几张图片秒级生成可探索3D场景

影溯将最新研究成果做成免费3D捕捉工具Crystal空间相机,背后技术QuerySplat已开源。其模型Topos - Lite改变组织三维空间方式,少量图片就能秒级生成3D场景,还能扩展容量。影溯团队经验丰富,技术应用场景广。

机器之心
产品应用8

阿里 Qwen3.8 正式发布:2.4T 规模,自主编程 16 天搓出一个 Hermes Agent

8月3日,阿里巴巴发布新一代基座大模型Qwen3.8,总参数量2.4万亿,性能居全球第一梯队。其API已上线千问AI平台,还接入“千问办公”。Qwen3.8编程和办公能力强,还将开源,性价比高。

AI前线
新闻资讯8

影身智能完成多轮融资,用原生3D数据重新定义机器人认知|甲子光年

影身智能已连续完成多轮融资,累计近亿元。其以‘原生3D动态世界模型’为核心技术,采用与市场不同的‘升维’思路,用自研的‘影身360’系统采集3D数据,还落地柔性智造行业,目标是打造通用人工智能产品。

甲子光年
产品应用8

谷歌最强AI图像模型Nano Banana 100+精选案例,商业级 AI 创意图集!附高清Prompt

Awesome-Nano-Banana-images收集Nano-banana在各任务场景生成的惊艳图片与提示词,展示Google图像生成与编辑无限可能。文中列举插画变手办、根据地图箭头生成图片等110个案例及对应输入和提示词。

AI Reading Hub
算法论文8

ICML 2025 Spotlight|南洋理工陶大程教授团队等提出基于RAG的高分辨率图像感知框架,准确率提高20%

南洋理工陶大程教授团队等合作,为解决多模态大语言模型处理高分辨率图像问题,探索 RAG 应用可行性,提出 Retrieval-Augmented Perception (RAP) 框架,在多任务上提升性能,已被 ICML 2025 接收。

机器之心
算法论文8

任意骨骼系统的模型都能驱动?AnimaX提出基于世界模型的3D动画生成新范式

传统3D动画制作依赖骨骼绑定与关键帧编辑,成本高。现有自动化方法有局限。北京航空航天大学团队提出AnimaX框架,结合视频扩散模型与骨骼动画优势,支持任意骨骼拓扑,生成动画质量高、速度快,泛化能力强。

机器之心