3D人体生成」共找到 3848 篇相关文章

新闻资讯8

刚刚,谷歌Gemini 3.8登场!姚顺宇:RSI巨大飞跃

深夜谷歌推出Gemini 3.8,六周内第三款Flash系列模型。含通用的Gemini 3.8 Flash和网络安全专用的Gemini 3.8 Flash Cyber,提升推理、代码能力,在多场景表现出色。已面向不同群体开放。

机器之心
产品应用7

智能PPT生成系统

MultiAgentPPT是基于A2A + MCP + ADK的多智能体系统,能流式并发生成高质量PPT。它通过多智能体协作,从大纲生成到内容汇总,提高效率与准确性,还介绍了使用界面、项目结构、快速开始步骤等。

GitHubStore
开源动态8

将庞大3D世界装进手机!李飞飞Spark 2.0开源

李飞飞团队开源核心技术Spark 2.0,可优化3D世界,让普通设备通过浏览器流畅访问交互。它有自动选细节、分批加载、优化存储三绝招,适配主流框架,有望改变与数字世界互动方式。

AIGC开放社区
算法论文8

CVPR 2025 | SketchVideo让手绘动起来,视频生成进入线稿时代

中国科学院大学等团队提出基于线稿的可控视频生成和编辑方法SketchVideo,发表于CVPR 2025。它基于预训练模型添加线稿控制网络,解决现有视频生成模型可控性等问题,实现高质量视频生成与编辑。

机器之心
开源动态7

3 天上了两个 SOTA 模型,视频 Agent 们接得过来吗?

7月31日MiniMax H3和字节跳动Seedance 2.5同日发布,3天后H3开源,8月7日Seedance 2.5开放api。模型变强使产品层要做的事更多,视频Agent需解决生产问题,竞争走向模型层之上。

Founder Park
算法论文8

AI自动写学术综述:10分钟生成6万字,成本不到四块钱

上海人工智能实验室等单位提出SurveyForge框架,能自动化生成高质量学术综述论文。它有双数据库协同驱动的大纲生成机制、学者导航代理SANA和并行生成与协调机制。还有SurveyBench评估框架,实验显示其效果好,应用前景广。

量子位
开源动态8

浙大开源PhyEdit:单图编辑+精准3D物体操作 | ACM MM'26

浙江大学ReLER团队开源的PhyEdit,用3D foundation model明确目标几何,让DiT图像编辑器负责最终渲染。单张图片里物体能移动并形成连续状态,在多项指标表现出色,还具备多种能力,已被ACM MM 2026接收。

新智元
产品应用7

我花12小时深度实测,阿里Qwen-3 Coder被Kimi K2“吊打”!

作者花12小时在真实项目中实测阿里Qwen - 3 Coder和Kimi K2。结果显示,Kimi K2在任务成功率、指令遵循、Bug修复、代码重构等方面全面领先,成本还更低,作者更推荐Kimi K2用于代码开发。

探索AGI
新闻资讯7

全国首部“AI生成内容合规”标准,现公开征集起草单位和个人

随着AIGC转向产业落地,监管对生成内容管控成趋势。全国首个AI生成内容合规团体标准《人工智能生成内容合规管理指南》应运而生,它规范合规要求,还提供四大核心路径解决企业痛点,现征集起草单位和个人。

AI工程化
开源动态8

最强3B「小钢炮」,代码数据全公开!推理随意开关,128k超长上下文

Hugging Face推出30亿参数模型SmolLM3,支持128k长上下文,训练等全链路开放。它在架构、数据混合策略等多方面优化,性能超Llama3.2 - 3B等,还公开双模式指令模型构建方案。

新智元