三维视频扩散模型」共找到 1246 篇相关文章

开源动态8

多模态开发革命!Gabber开源:图形化构建实时AI应用,效率提升10倍!

AI应用迈向多模态交互,传统开发方式周期长。开源项目Gabber是实时AI应用引擎,通过模块化与图形化简化开发,有诸多特性,还给出安装指南,适用于多种场景。

开源星探
开源动态8

超长推理还能节省计算!Salesforce开源神器两连发:教大模型边想边省,显著提升数学编程准确率

Salesforce AI Research开源Elastic Reasoning和Fractured Sampling。前者将推理流程分两部分,分配token预算,使输出缩短、准确性提高;后者打碎推理链条,从三维度采样,以更少tokens换更高准确率,均提升数学和编程任务准确率。

量子位
开源动态7

当「提示词工程师」开始像制片人一样思考,Seedance 2.0 Skill OS 深度解析!

AI 视频工具圈存在模型强但使用方式单一、信息孤岛和提示词‘玄学化’问题。`seedance - 2.0` 仓库搭建‘操作系统’,将‘提示词’升级为可审计制作流程,还给出各岗位产出表和使用方式。

开源星探
开源动态8

刚刚,智谱和华为搞波大的:中国首个国产芯片训练出的SOTA多模态模型!

智谱与华为合作开源新一代图像生成模型GLM-Image,是中国首个全程用国产芯片训练的SOTA多模态模型,擅长文字渲染,拿下多项榜单第一,API调用一张图只要0.1元,还解析了其技术架构。

量子位
开源动态8

字节开源版Seedance发布,超越Sora 2!

字节Alive团队发布开源版Seedance 2.0,在人类评估中超越Sora 2等。它通过统一架构、时空对齐技术和非对称训练策略,解决声画不同步和画质音质难两全问题,还建立数据流水线和测试基准。

AIGC开放社区
开源动态8

视觉强≠能干活!清北普林斯顿等开源WorldArena,世界模型评测被颠覆

2026 年 2 月 13 日,清华、北大等顶尖机构联合推出的 WorldArena 面向全球开源。这是首个‘功能 + 视觉’统一评测体系,撕开了‘美丽视频’伪装,让评测从‘审美导向’走向‘功能导向’。

机器之心
产品应用7

马斯克转帖,发现了一个有趣的中国 AI 初创产品!

马斯克转帖一个搞怪视频,其中互动内容由AI工具Loopit制作。Loopit是北京涌跃智能科技有限公司新推出的产品,介于Sora App和Spielwerk之间,玩法多样,或掀起一波风浪。

特工宇宙
产品应用8

AI体育教练来了!中国团队打造SportsGPT,完成从数值评估到专业指导的智能转身

现有智能体育系统多停于‘打分+可视化’,通用大模型处理体育生物力学分析有局限。中国团队提出SportsGPT框架,实现从‘动作评估’到‘训练处方’智能闭环,各模块优势明显,超越基线。

量子位
新闻资讯7

Meta与Midjourney合作,集成在新模型中

Theverge消息,Meta首席人工智能官宣布将Midjourney技术整合到未来AI模型和产品。合作对Meta意义大,可对标领先模型。Meta早有布局,Midjourney发展快且营收可观,采用订阅制。

AIGC开放社区
新闻资讯8

潘建伟团队突破量子操控极限!AI助力2024个原子60毫秒精准重排

潘建伟团队利用AI技术,60毫秒内构建2024个原子的无缺陷二维和三维原子阵列,刷新世界纪录。系统保真度追平国际最高水平,为构建容错通用量子计算机奠定基础。

量子位