「3D世界构建」共找到 4332 篇相关文章
“AI大神”李沐终于开源新模型,爆肝6个月,上线迅速斩获3.6k stars!
7月23日,“AI大神”李沐开源音频基础模型Higgs Audio v2,构建于Llama - 3.2 - 3B之上,预训练数据丰富。该模型在多个测评中成绩领先,有多种能力,李沐介绍其技术及训练方法。
上下文记忆力媲美Genie3,且问世更早:港大和可灵提出场景一致的交互式视频世界模型
交互式长视频生成缺乏稳定场景记忆,制约下游应用落地。Google DeepMind的Genie 3有强场景一致性但未公开技术细节。港大和可灵提出的Context as Memory模型,上下文记忆力媲美Genie 3且投稿更早,还提升了计算效率。
“DeepSeek-V3基于我们的架构打造”,欧版OpenAI CEO逆天发言被喷了
欧洲版OpenAI(Mistral)CEO Arthur Mensch在访谈称DeepSeek-V3基于其架构构建,引发网友质疑。经对比,Mixtral与DeepSeek的SMoE论文虽研究方向相同,但架构思路差异大,此前Mistral 3 Large还曾被指照搬架构。
腾讯AI战略大升级:组织架构重组与混元世界模型1.5发布
2025年12月17日,腾讯宣布两项重大举措,一是重组AI组织架构,成立新部门并任命首席AI科学家;二是发布混元世界模型1.5,能实时生成可交互3D虚拟世界,应用场景广泛,或引领行业进入‘AI原生’新阶段。
中国黑马狂赚3亿美金!国内AI应用断层第一,估值20亿美金
演语科技完成近3亿美元B+轮融资,投后估值超20亿美元。其ARR超3亿,构建起业务闭环。旗下LibTV、LiblibAI和星流表现出色,创始人陈冕布局生态,演语已成全球第一梯队玩家。
马斯克xAI正式入局世界模型,目标:明年搞出个AI生成的大游戏
马斯克的xAI入局世界模型开发,对手是Meta和谷歌等。其从英伟达挖专家,目标是开发先进AI系统,还计划明年底前发布AI生成游戏。不过构建世界模型挑战大,游戏行业有人对此谨慎。
LiblibAI 母公司完成近 3 亿美元融资:AI 应用层开始进入「收入说话」的阶段
近日,演语科技披露近3亿美元B+轮融资,投后估值超20亿美元。其旗下有LiblibAI、LibTV、星流等业务,已构建AI创意内容生产应用矩阵。截至2026年5月,ARR达3亿美元,收入年同比增超3000%。
波士顿动力机器人进厂打工现逆天操作!3D感知+实时追踪,人类捣乱完全不带怕的
波士顿动力的Altas机器人重磅升级,具备3D空间感知和实时物体追踪能力,可自主执行复杂工业任务。文章还解析其背后技术,包括2D感知、3D感知、物体位姿估计和校准等,团队未来将构建统一基础模型。
「世界理解」维度看AI视频生成:Veo3和Sora2水平如何?新基准来了
近年来,T2V模型进展显著,Sora2爆火引发对其是否为‘世界模型’的探讨。传统基准无法系统衡量模型对事件因果等的理解,中山大学等团队提出新评测框架VideoVerse,评测主流模型并发现开源与闭源模型差距及各模型缺陷。
4个月融进1亿美元、建齐3座「数据发电厂」,这家TechBio要造一个生物世界模型
原生AI TechBio公司寻明生科4个月融1亿美元,欲搭建横跨数字与生物世界的药物发现基础设施。其聚焦抗体药物设计,构建干湿实验闭环,推出AuraIDE和OpenDDE,采用“既卖引擎,也卖车”商业模式。