多视角视频扩散框架」共找到 1329 篇相关文章

算法论文8

无VAE扩散模型! 清华&可灵团队「撞车」谢赛宁团队「RAE」

清华大学智能视觉团队和快手可灵团队联合推出《Latent Diffusion Model without Variational Autoencoder》,提出 SVG 框架,用预训练视觉特征编码器替代传统 VAE,解决了传统「VAE + Diffusion」范式的效率与通用性痛点。

机器之心
产品应用8

阿里Qwen3一大波更新:代码生成、视频、图片、语音全都有

阿里Qwen3迎来一大波更新,涵盖多个模型。如Qwen3-Max在代码与智能体表现卓越;Qwen3-VL是强大视觉语言模型;Qwen3-Omni是全模态模型;还有图像编辑、同传、安全防护等模型及旅行规划师等应用。

AIGC开放社区
算法论文8

Google新研究:降低大模型幻觉的全新视角——充分上下文!

谷歌新研究《SUFFICIENT CONTEXT: A NEW LENS ON RETRIEVAL AUGMENTED GENERATION SYSTEMS》提出“充分上下文”概念,剖析RAG系统失败原因并给出解决方案,对提升企业AI准确性和可靠性有重要意义。

AI工程化
新闻资讯7

神秘「欢乐马」霸榜视频模型!本以为Seedance2.0已封神…

神秘模型HappyHorse - 1.0悄然登顶Artificial Analysis的AI Video Arena排行榜,在多个赛道力压Seedance等模型,呈现断层式碾压。它或出自阿里淘天未来生活实验室,据说完全开源,10号将正式发布。

量子位
开源动态7

OpenMAIC:一键生成互动课堂,视频+PPT全都有,还可以编辑

清华开源项目OpenMAIC是多智能体互动课堂,上传文档或描述主题,几分钟就能生成虚拟课堂,AI教授讲课、同学讨论,还有白板功能。底层用LangGraph编排,支持主流模型,有OpenClaw集成,架构完整。

AI工程化
产品应用8

上帝视角!DeepMind提前5天锁定Melissa,强度预报不再靠天

飓风Melissa来临前,DeepMind算法提前5天预言其强度变化。该模型用两类数据训练,能生成多种未来场景,在路径和强度预测上优于传统模型,已被NHC投入实战,但AI不能理解灾难,人类仍需做决策。

新智元
产品应用7

容器可观测新视角: SysOM延时监控助力定位业务抖动原因

云原生场景下,资源超卖和混合部署使宿主机与容器化应用资源竞争加剧,引发内核级延迟问题。本文结合实战案例,介绍用ack - sysom - monitor Exporter分析定位内核延迟,还介绍了SysOM监控及解决系统延时的方法。

阿里云开发者
开源动态8

仅需0.7秒单图像实时3D重建,开源扩散模型

单图像3D重建是计算机视觉难题,传统基于回归和生成式方法各有局限。Stability - AI开源SPAR3D模型,融合两种方法规避局限,仅0.7秒完成单图实时3D重建,实验显示性能显著优于其他基线方法。

AIGC开放社区
开源动态7

Harness Engineering 的防御视角:从 Codex Security 看 AI 生成代码的治理

作者用 Codex Security 分析项目,发现它不仅列漏洞,还提供攻击路径等。AI 没创造新漏洞,却放大缺陷,需新方式治理大规模自动生成代码,Harness Engineering 有防御价值。

phodal
新闻资讯7

交大高金朱宁:经济学家视角下AI时代的范式思维转变 | MEET2026

上海交通大学朱宁在大会指出,AI使稀缺概念改变、经济学逻辑动摇,带来全球财富分配、贸易和社会伦理法律等问题,还模糊了工作界限,建议人们思考与AI共生。

量子位