「3D人体生成」共找到 3848 篇相关文章
网友疯玩Gemini 3!AI造物门槛真是0了
才发布一天,Gemini 3 Pro就被网友玩出花。热门玩法数字拍立得,复古照片直出;还能打造AI版“4399小游戏”网,及“一张图造应用”玩法,如将图片转化为游戏、网站等。
腾讯重磅开源!端到端视频音效生成模型HunyuanVideo-Foley
腾讯混元正式开源端到端视频音效生成模型 HunyuanVideo-Foley,适用于多场景。它采用新型框架结合 REPA 策略,有三大核心优势,能适配多种场景,抑制底噪,保证音频保真度。
智谱联合清华开源多图参考视频生成模型,带来主体一致性新高度
合肥工业大学、清华大学和智谱开源多主体参考视频生成模型Kaleido。它用全新数据构建法和精巧架构,解决主角与背景混淆难题,实验显示其在多维度表现优异,超越现有开源模型。
AI 会生成 PPT 之后,Runtime 决定了它能做多好
作者回顾PPT Agent发展,指出存在Agent理解操作文档及AI生成PPT表达单一的问题。提出Artifact Runtime概念,它让PPT可被持续操作,还能接管重复决策,但不能替代专业判断。
狂肝一周,测评十余款 PPT AI 生成产品的真实反馈
评估 Agent 产品能力复杂,以 PPT 生成为例,有 Agent 和模板化两种流派。作者选前者投票测评、后者全方位测试。给出方案,还推荐不同需求适用产品,附总榜单和细致体验描述。
最新发现!每参数3.6比特,语言模型最多能记住这么多
Meta、DeepMind等团队研究语言模型记忆容量,提出新方法估计模型对数据点的‘了解’程度,发现GPT系列模型约每个参数3.6比特,还提出模型容量等相关定律,激发社区多方面思考。
DeepSeek-V3.1 发布,官方划重点:Agent、Agent、Agent!
2025年8月21日,DeepSeek V3.1正式发布。它采用混合推理架构,支持双模式,网页端、App、API均升级,上下文拓展至128K。其智能体能力增强,思考与输出效率提升,还具备API新特性,模型已开源,价格也将调整。
谷歌北大联手学术版Banana爆火,论文图表100%精确生成
谷歌与北大联手推出学术版PaperBanana,能100%精确生成论文图表,美观度和逻辑清晰度超原版。它由5个智能体分工协作,经实验在各维度超越传统基线方法,已在GitHub获上千star。
AI游戏生成迎来「机制觉醒」:可自我进化的玩法设计师
文章指出当前大模型生成游戏存在玩法创新不足、评分虚高等问题。CreativeGame技术关注此问题,通过先写设计文档、激发创意、设计记忆架构等方式,让AI围绕机制持续迭代,探索可解释、可追踪、可迭代的创作范式。
The Batch: 929 | Qwen3.5 超越更大模型,领跑视觉基准测试
阿里巴巴发布 Qwen3.5 系列,含 8 个开源权重的视觉 - 语言模型。其小模型表现超大体量 OpenAI 开源权重模型,在视觉任务中整体出色,部分在语言任务也有竞争力。虽团队有人员离职,但阿里承诺加大 AI 投入。