3D场景建模」共找到 3848 篇相关文章

新闻资讯8

AI最尴尬的短板,中国科学院出手了

7月24日,中科院计算所“知境”团队发布知境社会心智大模型技术体系,为现有大模型补社会心智短板。其建评测体系SoMBench,设计训练系统Zing,用部署架构Actio,在多评测超越GPT - 5.5等,应用前景广。

量子位
开源动态7

Lucide 1.0 发布,移除品牌图标,并缩减数百万个项目的包大小

Lucide 1.0 发布,它是开源图标工具包,是 Feather Icons 分支。此次移除品牌图标,缩减 lucide - react 包大小,还引入上下文提供程序等改进,社区反响有赞有弹。

InfoQ
开源动态8

25个实战案例告诉你:原来 Blender + Seedance 才是AI视频创作的终极组合!

文章介绍开源仓库Awesome-Blender-Seedance-Workflow-Usecases,汇集25个Blender与Seedance结合的实战案例。阐述两者组合原理及优势,展示多类案例亮点,还给出快速上手指南,体现人机协作创作新理念。

开源星探
开源动态8

JSON 瑞士军刀,效率直接起飞!

现在很多接口、日志、配置文件用JSON,数据结构复杂时处理麻烦。`jq`是专门处理JSON的工具,支持格式化、过滤、提取等操作,语法简单,在多场景常见,安装方便。

开源先锋
开源动态8

告别Selenium!这个8K+星的AI浏览器自动化神器,让爬虫开发效率飙升10倍

传统浏览器自动化工具基于‘精确选择器’,网站改版代码易崩溃。而Stagehand是新一代AI浏览器自动化框架,用自然语言控制浏览器,开发效率提升10倍,维护成本降80%,还具备自然语言操控、自我修复等功能。

小华同学ai
开源动态8

2.4K Star!小米最新开源!覆盖600+语种的语音克隆TTS,40倍实时合成速度!

小米k2 - fsa团队开源OmniVoice,这是支持600 + 语种的零样本语音克隆TTS模型,性能超ElevenLabs v2和MiniMax等标杆,RTF低至0.025,合成速度快40倍,还支持声音设计等功能。

开源星探
算法论文8

CVPR 2026|1分钟单图变4D视频!AI看图直接脑补物理规律

北京理工大学和理想汽车等团队提出全新框架PhysGM,引入DPO实现端到端快速前馈推理,能1分钟内将单图生成为4D动态视频,在速度和评价指标上超越主流模型,相关工作被CVPR 2026接收且代码已开源。

机器之心
算法论文8

北航,清华,北大联合发布: 异构智能体协同强化学习!

北航、清华、北大联合发布异构智能体协同强化学习论文。提出 HACRL 新范式,实现异构智能体双向互学与独立部署统一;还有 HACPO 算法弥合智能体差异。实验显示性能提升且成本降低,为多智能体协同学习指明方向。

机器之心
算法论文8

计算所 x 上交大论文:只用双人数据,也能生成多人动画丨CVPR 2026

中国科学院计算技术研究所与上海交通大学团队提出多人物动画生成框架MultiAnimate,引入身份标识与空间关系建模方法,用双人数据训练,能扩展到多人动画生成,优于现有方法。

AI科技评论
产品应用8

字节豆包2.0重磅发布!成本暴降一个数量级,Seed团队揭秘视频Agent竞争关键

今日字节发布豆包大模型2.0系列,围绕大规模生产环境需求优化,有Pro、Lite、Mini和Code四款模型。其Token单价低一个数量级,多模态理解能力升级,未来将围绕长链路智能系统构建发展。

InfoQ