三维视频扩散模型」共找到 1246 篇相关文章

新闻资讯7

3年手搓ChatGPT!剑桥天才少年在Minecraft游戏中爆火回归

MC大神sammyuri时隔3年发布新作,在MC中复刻ChatGPT,名为CraftGPT。虽参数量小,但用Transformer架构,能和用户交互。模型训练用Python和小数据集,视频存档公布助理解原理。

新智元
新闻资讯8

80%美国AI初创靠中国开源模型“吃饭”!a16z投资人震惊,全球开源榜前16名全被中国包揽

Reddit上“中国开源AI模型席卷美国初创”帖子爆火。a16z合伙人Martin Casado称80%美国AI初创融资路演用中国开源模型。Design Arena榜单前16名开源模型全是中国的,中国开源模型优势尽显。

InfoQ
新闻资讯7

哈佛重磅预警!经济学家预言:全球AI失业潮2年来袭,世界经济大崩盘在即

哈佛商学院视频采访美国经济学家Anton Korinek,他预警AGI可能2 - 5年实现,AI失业潮将席卷全球,经济或崩溃。他还谈及AI对经济影响、普通人应对办法,建议重新思考收入分配制度等。

新智元
开源动态7

李飞飞空间智能独角兽开源底层技术!AI生成3D世界在所有设备流畅运行空间智能的“着色器”来了

李飞飞创立的World Labs开源核心技术Forge渲染器,可在各设备实时、流畅渲染AI生成的3D世界。它是Web端3D高斯泼溅渲染器,地位似传统3D领域“着色器”,还解决了3DGS渲染难题。

量子位
开源动态8

谢赛宁等推出统一多模态模型!替代VAE实现图像理解/生成双SOTA,代码权重数据集全开源

谢赛宁等团队推出统一多模态模型Blip3 - o,用扩散Transformer生成CLIP图像特征,采用顺序预训练策略。对比多种设计方案,确定CLIP + Flow Matching最佳,模型在多任务测试表现卓越且全开源。

量子位
新闻资讯7

AI音乐赛道单笔最大融资:ACE完成4000万美元Pre-B轮 | 5Y News

AI音乐生成赛道竞争聚焦于‘谁更可控’,ACE团队由郭靖创立,既推出专业音乐制作工具ACE Studio,又面向大众打造Miya平台。公司获4000万美金Pre - B轮融资,欲构建覆盖全流程的音乐平台。

五源资本 5Y Capital
新闻资讯8

今年 AGI 大会上,这 10 个创业团队最受关注

在 AGI Playground 2026 的 Founder Show 活动上,10 个创业团队展示项目,横跨 Agent 基础设施、Physical AI 等方向。如 Tap8 实时生成交互视频,EigenFlux 为 AI Agent 建网络,Aceii One 是 AI 网球机器人等。

Founder Park
产品应用7

红杉高瓴投资,前美团民宿 CEO 联合伯克利教授,做了一只 AI 蘑菇

Sowii 推出潮玩「秃秃」,首批 3 万件两天售罄,后续预售超 20 万件。创始人冯威赫是前美团民宿 CEO,联合创始人是伯克利教授。该产品让用户对非人类对象产生关注并建立关系,探索数字生命新形态。

Founder Park
算法论文8

不用头显也能看3D:清华团队把裸眼3D视角扩大到150°

清华大学戴琼海、吴嘉敏团队在 Nature Photonics 发表研究,提出“超斯涅尔扫描光场显示(SSS - LiD)”方案,在 150°超宽视角下实现高分辨率裸眼 3D 显示,还分析了裸眼 3D 技术的商业化前景。

DeepTech深科技
开源动态8

真可用!美团数字人模型开源,MV、电商等统统拿下

美团开源数字人视频生成框架 LongCat - Video - Avatar 1.5 版本,换音频编码器、加速推理,支持多任务与多场景。经770人评测,它在多维度领先对手,各方面表现均衡,效率与质量兼得。

AIGC开放社区