生态全景图」共找到 1137 篇相关文章

产品应用8

拿下3D生成行业新标杆!昆仑万维Matrix-3D新模型鲨疯了,一张建模游戏场景

昆仑万维推出3D世界生成框架Matrix - 3D,能从单像生成高质量、轨迹一致的全景视频并还原可漫游3D空间。它优势明显,还突破多项技术难题,背后是昆仑万维对空间智能的战略布局。

量子位
产品应用7

给 AI 一张陶罐碎片,它能还原破裂过程吗?Minimax H3 vs Seedance 2.0 Fast 实测

文章实测 MiniMax H3 和 Seedance 2.0 Fast,给模型一张破碎陶罐,让其生成破碎过程视频。分析 H3 技术逻辑,对比两模型效率、质感和物理细节等差异,指出开放与闭源模型的特点及视频模型待解决的问题。

AI科技评论
开源动态8

一文看懂 TritonNext 2026:FlagOS 亮点详解、语言扩展新趋势、AI 生成更加“底层”、芯片软件生态或迎“新拐点”!

1月9日,「2026 TritonNext技术大会」召开,专家探讨AI编译器等最新解法。如林咏华介绍FlagOS v1.6应对生态难题;崔慧敏用“AI for Compiler”破芯片演进难题;上海人工智能实验室推出DLCompiler打破算子开发困境等。

AI科技大本营
算法论文8

因果发现大模型迎来「理论破局」: DAG-FM 破解异质机制下的因果识别与涌现难题 | GAIR Paper 116

浙大、清华与稳准智能联合发布因果发现大模型DAG - FM,解决了现有模型缺乏理论基础、易产生非法环路和显存爆炸问题。它在理论上证明因果可识别,架构上避免环路,处理数据能力强,还将推进特定领域预训练。

AI科技评论
开源动态8

SD又回来了!一秒出,手机就能玩:SD3.5-Flash让专业AI绘画进入“闪电”时代

Stability AI联合萨里大学SketchX实验室推出SD3.5-Flash模型,能在普通电脑甚至手机上快速生成专业级高分辨率片。它将推理步骤压缩、显存要求降低、出时间大幅缩短,画质也没明显缩水,还在性能上反超SD3.5M。

AIGC开放社区
产品应用8

99%的AI产品都没有真正的护城河,初创产品需要做好「细分场景+生态协同」 | 对话AI播客工具Podwise

量子位智库对话Podwise创始团队,探讨AI播客工具发展。团队分享Podwise目标用户、场景、优势,如转录准、能识别声纹等。还谈及产品开发、付费、用户增长等策略,强调做好细分场景与生态协同。

量子位
开源动态8

5B参数+4060Ti,10秒出,全流程开源可复现!补齐统一多模态生成编辑的开源版,让高质量像生成真正变得更轻量、更普及

近日,多机构联合发布统一多模态生成编辑模型DeepGen 1.0,仅5B参数,集成五大能力,4060ti 16G上10秒出,多项指标超大4倍工业级模型。团队开源全流程代码与数据,可从零复现。

量子位
开源动态8

CVPR 2026 | 谷歌DeepMind重磅开源多模态TIPSv2:实现Patch-Text对齐的最优表现

谷歌DeepMind推出多模态TIPSv2,解决像块与文本嵌入对齐难题。它有三大核心技术创新,在9项任务和20个数据集表现出色,特征优势显著,且配套生态完善,为AGI预训练指明方向。

机器之心
算法论文8

工具增强的多模态LLM综述

多模态大语言模型(如GPT - 4V)虽有强大文理解能力,但受数据稀缺、复杂任务表现不佳和评估标准不统一限制。论文提出为MLLM集成外部工具,构建全景,覆盖多维度,还指出挑战与对策。

深度学习自然语言处理
新闻资讯7

理解了巴菲特“补票”谷歌,就理解了字节、阿里与腾讯的AI入口大战

2026年初,字节、阿里、腾讯围绕AI入口与生态展开争夺。从巴菲特卖苹果买谷歌案例可理解这场大战,谷歌建成AI全栈生态,其他科技巨头布局时各有挑战,AI时代建立生态才能不败。

芯师爷