「PPT 生成产品」共找到 3683 篇相关文章
从「片段生成」到「长视频漫游」:OmniRoam探索轨迹可控的长视频生成新范式
在生成式视频发展中,长时序视频生成面临挑战。研究者提出 OmniRoam 新方法,通过全景表示和分阶段生成框架,提升视频时空一致性,还构建数据评测体系,实验表现优,有效率和 3D 应用潜力。
腾讯祭出开源核弹!LeVo音乐生成模型,媲美Suno,支持零样本风格迁移,歌词完美匹配
音乐生成领域有重大突破,腾讯AI Lab开源高保真音乐生成模型LeVo。它由LeLM和音乐编解码器组成,能解决现有方法在音质、音乐性等方面的局限,实验显示其优于现有方法,功能强大且适用场景多。
英特尔中国 40 年,未来战略明确:坚持代工业务,Intel 18A 是未来三代产品基石
在英特尔产业创新大会上,英特尔明确战略方向,坚持代工业务,以 Intel 18A 为未来三代产品基石。明年将推更多基于该制程的产品,还发力新兴市场。此外,其 Panther Lake 平台性能飞跃,推动 AI PC 发展,也助力机器人市场。
硅谷大厂开始AI-first换血:先裁3万人、再招8000个新人,传统产品经理正在被Builder淘汰!
随着AI浪潮席卷,产品经理职业正经历“角色重定义”,需成为“builder”。Nikhyl Singhal指出,未来12 - 24个月会“先大规模裁员,再大规模重招”,builder将迎来好时代,产品管理将更重构建与创造。
盛大AI研究院新作:流式生成超越非流式,一句话让虚拟人动作丝滑如真,推理延迟仅1帧
盛大AI研究院与东京大学联合提出FloodDiffusion,首个基于定制化扩散强制的流式人体动作生成框架。它能零延迟生成无限长动作序列,解决了现有方法的问题,在多数据集评估中表现优异。
更少的token生成更好的图!香港大学联合阶跃星辰等让AI绘画真正理解了再画
香港大学、阶跃星辰等用VFMTok新方法,让图像生成模型借用顶级视觉AI的眼睛看世界,实现更快、高质量图像生成,且无需复杂引导技巧。它改变图像理解方式,将像素死记硬背转为语义理解。
CVPR 2025 | 如何稳定且高效地生成个性化的多人图像?ID-Patch带来新解法
本文围绕个性化多人图像生成展开,指出其面临身份特征泄露等挑战。介绍了早期方法的不足,提出全新的ID-Patch方案,阐述其设计思路、实验效果等,还探讨了提升空间与未来方向,该方案在多人物图像生成中有突破式提升。
在参与OpenAI、Google、Amazon的50个AI项目后,他们总结出了大多数AI产品失败的原因
Aishwarya Naresh Reganti 和 Kiriti Badam 参与超50个企业级AI产品构建。他们指出,如今AI产品构建成本降低,但多数仍失败。还分享开发陷阱与路径,如从低自治高控制起步、建立CC/CD框架等,也对AI未来发表看法。
独家丨专访 Tunee 产品负责人:国内首个对话式音乐创作 Agent,刚上线就好评如潮!
文章是对 Tunee 产品负责人的专访。Tunee 是国内首个对话式音乐创作 Agent,能记住用户偏好,自动完成母带与混音。团队坚持‘人人都能玩点音乐’,将在云栖大会发布新模型与吉他,还探讨了产品问题与未来规划。
对谈CREAO:20人团队、每天上线8个功能,在Pivot产品之前,我们先Pivot了组织
CREAO 创始人程凯等分享创业历程。最初产品用 AI 构建传统软件未成功,后先对组织进行 AI Native 改造,围绕 AI 重新打造开发流程,推出 Super Agent 产品,核心是 Coding Agent,上线两周获超 3000 万美元融资。