「三维场景生成」共找到 3827 篇相关文章
Gemini 的 PPT 生成:使用技巧及模板提示词
Gemini APP 上线 PPT 生成能力,可通过提示词精细控制,还能与谷歌产品打通。文章介绍其使用方法,如开启 Canvas 模式、利用搜索填充内容等,还分享百搭 PPT 风格提示词。
用“蒸汽机”生成视频,还能音视频一体化交付?
8月21日百度营销发布百度蒸汽机2.0,含多版本,有声版可音视频一体化交付。经测试,其生成视频细节佳、运动规律合理。它能解决影视业诸多痛点,成本低,还可免费使用。
第十一章 Deep Agents 实战——数据分析与报告生成
本章介绍构建营销内容 Agent,能分析产品数据、生成营销文案等。核心技术有结构化输出、多 Skill 水平组合、模拟数据分析。还对比传统营销与 Agent 流程,展示结构化输出优势及数据驱动决策方法。
以「场景」定义算力:AI时代,通用算力不只“通用”
当AI狂欢席卷全球,阿里云和AMD通过‘一芯三用’重新定义AI时代算力选型逻辑,从‘参数崇拜’回归‘业务本质’。联合发布三款基于AMD Zen 5架构‘Turin’处理器的全新ECS实例,精准匹配不同业务场景需求。
生成式推荐!推荐系统新范式还是新噱头?
文章围绕生成式推荐展开,介绍其概念,探讨效果和成本问题。以Meta的GR和快手的OneRec为例,分析收益与开销,指出不同团队应用情况,认为它或带来架构革新,也提醒勿盲目跟风。
简单快速的用 Claude Code 帮你创建 PPT 生成 Skills
Claude Code热度高,其Skills可辅助构建简单Agent。作者以创建Nano Banana PPT生成Skills为例,教大家安装、使用及创建Skills,还提及Skills迭代和局限性等内容。
Lumina-DiMOO:多模态扩散语言模型重塑图像生成与理解
上海人工智能实验室推出多模态扩散语言模型 Lumina - DiMOO,它基于离散扩散建模,打破多模态任务壁垒。相比传统自回归架构模型,它解决了生成慢、质量受限等问题,在多项评测中夺魁。
效果非常不错!阿里昨开源图形海报生成模型Qwen-Image
阿里昨日开源多模态图像基础模型Qwen-Image,基于20B参数MMDiT架构,在复杂文本渲染和精确图像编辑方面有重大突破,支持多风格图像生成、智能图像编辑等,还介绍了使用、部署等方法。
一句话生成可上线的动效,这个项目真不错!
Github上的`Text-to-lottie`是开源Skill框架,可让Claude Code或Codex当动效设计师,按Lottie规范生成标准`lottie.json`。它有Coding Agent直出Lottie JSON、内置预览播放器等特色,助开发者快速产出合规Lottie资产。
ElevenLabs 发布“视频到音乐”:AI 读懂视频内容,为其创作氛围匹配的 BGM。
ElevenLabs推出“视频到音乐”功能,其“Eleven Music”模型能分析视频上下文、情绪和风格,一键生成匹配的定制背景音乐,还能添加画外音和音效,为创作者提供端到端音视频解决方案。