3D形象生成」共找到 3843 篇相关文章

算法论文8

高保真、多控制集成于「统一画布」,组合式图像生成新范式!

Canvas - to - Image是新型图像生成框架,将多种控制方式整合到统一画布,用户可直观操作生成高保真、多控制图像。它简化创作流程,解决了现有方法控制单一分散、交互性差的问题。

新智元
新闻资讯7

5个大疆离职员工,把3D打印带回风口

3D打印再度火热,街头地摊产品畅销,社交平台热度高。拓竹科技由5位大疆离职员工创立,其产品X1成绩亮眼,MakerWorld平台以积分制度吸引用户。如今3D打印因性价比、新消费、低门槛等因素升温。

量子位
产品应用8

Qwen3-LiveTranslate:视、听、说全模态同传大模型!

Qwen3-LiveTranslate-Flash 是基于大语言模型的多语言实时音视频同传模型,依托 Qwen3-Omni 能力与海量数据,有多语言和方言支持、视觉增强等亮点,性能超主流大模型。

通义千问Qwen
新闻资讯7

「AI生成的内容全部加水印」OpenAI、Anthropic、Google都签了

OpenAI、Anthropic、Google等公司签署欧盟《AI生成内容透明度行为准则》,承诺推进AI生成内容标记与检测。Claude已公布落实方案,文本水印早有先例,但「水印」可信度遭质疑。

机器之心
产品应用8

实测腾讯Hunyuan-Image2.0,首个毫秒级实时图像生成模型

今天上午腾讯发布混元图像2.0,以“更智能、更开放、更中国”为理念。其参数规模提升,推理时间大幅压缩,实现毫秒级实时生成,还在画面质量等方面升级,新增实时绘画板功能。

带你学AI
开源动态8

3.2K star!!高中生开发,媲美IDM,这款开源下载神器厉害了!

最近发现一款开源项目Ghost - Downloader - 3,由高中生独立开发,支持三平台,用Python编写且运行快,还融入AI技术自动调教下载策略。已有3.2K star,功能强大,安装和使用都简单。

开源先锋
算法论文8

推理速度飙升5倍,苹果提出全新Multi-Token生成框架!

自回归语言模型逐词生成文本拖慢推理速度、限制并行能力。Apple提出全新框架,挖掘其对未来词元“先验知识”,通过多项技术并行预测多词元,微调预训练模型可显著提速且不损输出质量。

PaperAgent
产品应用8

DeepSeek-V3.2-Exp:用稀疏注意力打破长文本效率瓶颈

在NLP领域,处理长文本时传统注意力机制效率低。DeepSeek团队推出DeepSeek-V3.2-Exp模型,引入稀疏注意力机制,在保持性能同时提高长文本处理效率,降低计算复杂度,在多基准测试中表现良好。

CourseAI
算法论文7

首个多人对话视频生成框架MultiTalk,角色有表情还能互动

现有音频驱动人体动画方法多聚焦单人,处理多音频流能力弱、指令跟随有局限。中山大学提出多人对话视频生成新框架MultiTalk,介绍了技术原理,演示效果显示其指令跟随能力强、伪影少。

带你学AI
推荐文章8

出价算法新SOTA——快手首提生成式强化学习出价

文章介绍快手新提出的生成式强化学习出价模型GAVE,回顾出价算法发展历程。GAVE结合生成式与强化学习优势,有Score-based RTG等创新,经竞赛、实验验证效果佳,为出价技术带来新方向。

王喆的AI笔记