「3D人体生成」共找到 3858 篇相关文章
4万亿刀,仅3.6万人!英伟达揭残酷真相:劳动正与财富大脱钩
英伟达市值突破4万亿美元,「每位员工对应市值」创新高,劳动与资本大脱钩现象凸显。科技巨头如苹果、谷歌等新增千亿营收所需员工数递减,沃尔玛非科技领域也有类似情况,还探讨了AGI及投资启示。
南洋理工 | 推出开源版MetaQuery:OpenUni,1.1B参数媲美BLIP3-o-8B
南洋理工大学 S-Lab 和商汤科技团队推出开源版 MetaQuery——OpenUni,仅 1.1B 参数就达 8B 模型性能。它架构极简、参数高效且完全开源,还采用两阶段训练策略,虽有局限但为多模态模型研究助力。
Loop-ViT:让AI学会「反复思考」,3.8M参数小模型追平人类平均水平
香港科技大学等团队提出 Loop - ViT,将循环 Transformer 引入视觉推理领域。该模型参数少但性能强,3.8M 小版本追平人类平均水平,揭示视觉推理任务中‘思考时间’比‘模型大小’更重要。
张小珺对话李想:3小时长谈总结(AI、VLA与组织进化)
张小珺半年前与李想3小时长谈,围绕AI展开多话题探讨。李想认为AI应成生产工具,赞赏DeepSeek,还分享VLA架构、理想终局规划,提出管理心法,思考AI与人关系。
生成式AI第二阶段:个性化AI助理 + AI Agent将颠覆我们的生活工作方式
生成式AI已迈入第二阶段,核心是能“动手办事”的AI智能体。未来AI以AI助理和AI代理形式存在,两者协同工作将带来工作方式革命,但面临记忆、信任、伦理等挑战。
RAE的终极形态?北大&阿里提出UniLIP: 将CLIP拓展到重建、生成和编辑
北大和阿里团队提出 UniLIP,解决了统一多模态模型中语义理解与像素重建的矛盾。它创新微调 CLIP,实现图像重建,还提出双条件架构用于生成和编辑,在多基准取得 SOTA 性能。
谷歌、OpenAI同日发布模型,一个最快最具性价比,一个主打「人情味」
深夜谷歌和OpenAI相继推出新版本大模型Gemini 3.1 Flash - Lite、GPT‑5.3 Instant。前者专为大规模智能设计,性价比高、速度快;后者让日常对话更稳定实用,减少幻觉,提升了多方面表现。
ACL 2025预定爆款!HyperGraphRAG横扫5大领域,检索效率提升7倍
文章介绍HyperGraphRAG模型,它由知识超图构建、超图检索策略、超图引导的生成机制三部分组成。构建含知识超图构建、超图检索、生成机制等步骤,能提升检索效率与答案质量,或成ACL 2025爆款。
面壁小钢炮 VoxCPM-TTS:开源端到端 TTS,轻量高效低延迟
面壁提出基于扩散自回归建模的端到端语音生成模型 VoxCPM,构建于 MiniCPM - 4 之上。它克服传统离散 token 方法缺陷,实现语义与声学特征解耦,有上下文感知语音生成和零样本语音克隆能力,低延迟。
60秒极限挑战!中国GPU独角兽杀出重围,斩获图形顶会大奖
2025年12月,SIGGRAPH Asia 2025在香港开幕,摩尔线程在3DGS重建挑战赛中凭自研技术LiteGS斩获银奖。该团队还开源3DGS基础库LiteGS,实现全链路协同优化,提升训练效率与重建质量。