变分自编码器」共找到 1174 篇相关文章

产品应用7

马斯克深夜点赞!内容的下一站是:玩!

马斯克深夜点赞用 Loopit 制作的互动 meme,引发关注。Loopit 让用户体验从‘看’‘玩’,实现双向交互。其融合 AI Coding 与多模态生成,构建 Runtime,解决延迟、状态同步等问题,潜力大。

AGI Hunt
推荐文章7

翻译:代码日趋廉价,软件依然昂贵

Claude Code等大语言模型工具强大,让软件构建门槛崩塌,迎来个人化软件时代。但构建有价值软件门槛仍高,代码虽廉价,软件维护等成本贵。工程师价值转向系统架构,真正挑战是发和辨实用价值。

宝玉AI
新闻资讯8

比豆包手机还狠!Gemini电视登场CES,谷歌打响客厅革命第一枪

2026年CES上科技新品频出,谷歌将Gemini AI引入Google TV,让电视具备自然语言内容发现与推荐、教育深度学习等功能,还增强语音控制能力,打响客厅AI革命第一枪,同时涂鸦智能展示了AI生活助手等产品。

新智元
开源动态8

告别“音画割裂”与“人物崩坏”!AutoMV:首个听懂歌词、卡准节拍的开源全曲级MV生成Agent

现有AI视频生成模型做全曲MV有时长限制、音画割裂和一致性差等问题。AutoMV作为开源多智能体系统,模拟人类影视制作流程,能生成长达数钟、叙事连贯且音画同步的完整MV。

量子位
新闻资讯7

微软拉响「红色警报」!纳德拉重回一线抓Bug,AI这仗输不起

微软CEO纳德拉亲自下场盯Bug、催进度,吐槽Copilot不够聪明。Copilot嵌入Office却不被用户青睐,AI竞争已从比能力转为比留存。当下用户更看重产品能否被留下,AI竞争关键在于‘寸感’。

新智元
推荐文章7

2026 将近,世界模型到底更「世界」了吗?

近期 Runway 发布相关产品,让「世界模型」讨论再聚焦。其定义从强化学习语境延伸,业内理解不断化,概念边界模糊。如今被推到和 LLM 同级,出现概念同名但内核裂现象。

机器之心
新闻资讯8

从好莱坞特效到AI芯片的十年之约:SIGGRAPH Asia 2025登陆香港!

2025年12月15 - 18日,SIGGRAPH Asia将在香港举办。相比2014年深圳会议,中国图形领域已从跟跑引领。此次会议亮点多,能展示中国技术突破,还为从业者提供交流合作机会。

新智元
新闻资讯8

DeepMind一篇论文终结十年之争!GPT-5推理靠世界模型

GPT-5上线后推理能力惊人。最新研究揭示通用智能体聪明的原因是长出“世界模型”,终结了学界十年关于AI靠模仿还是思考的争论,实验也验证了世界模型对智能体的必要性。

新智元
算法论文8

无VAE扩散模型! 清华&可灵团队「撞车」谢赛宁团队「RAE」

清华大学智能视觉团队和快手可灵团队联合推出《Latent Diffusion Model without Variational Autoencoder》,提出 SVG 框架,用预训练视觉特征编码器替代传统 VAE,解决了传统「VAE + Diffusion」范式的效率与通用性痛点。

机器之心
产品应用7

实测新版LiblibAI:终于把模型、生图、工作流塞进一个碗了

本文实测新版LiblibAI,它上线多个模型,添加视频特效玩法。从“找模型”网站为“AIGC流水线”平台,界面风格转。虽有亮点,但也存在出图慢、模型惊喜感弱、页面卡顿等问题。

量子位