帧间一致性」共找到 153 篇相关文章

新闻资讯8

HiDream-O1-World拿下WBench第一,交互世界模型的格局被改写|甲子光年

近日,智象未来的HiDream - O1 - World模型以平均分80.9登顶WBench核心Navi分榜,物理一致性维度也排第一。它走出第三条路线,解决时空与物理一致性难题,技术获国际顶会认可,正改变全球竞争格局。

甲子光年
算法论文8

ACM MM 2025 | 小红书AIGC团队提出风格迁移加速算法STD

小红书AIGC团队提出风格迁移加速算法STD。现有一致性模型在风格化任务有缺陷,文章提出从部分噪声状态出发的训练框架STD,设计轨迹状态库减轻计算负担,引入非对称对抗损失增强风格一致性,实验显示其效果优。

机器之心
算法论文7

PolyVivid实现多主体视频定制,身份一致性超越现有模型

现有视频生成模型在多主体定制中难保持身份一致与自然交互,上交和腾讯提出PolyVivid框架解决此问题。它在多方面优于现有方法,还介绍技术原理、演示效果,证明其在多领域有实用价值。

带你学AI
开源动态8

智谱联合清华开源多图参考视频生成模型,带来主体一致性新高度

合肥工业大学、清华大学和智谱开源多主体参考视频生成模型Kaleido。它用全新数据构建法和精巧架构,解决主角与背景混淆难题,实验显示其在多维度表现优异,超越现有开源模型。

AIGC开放社区
推荐文章7

关于现代GPU体系结构内存一致性(Memory Consistency)模型的一些猜想(二)——同步性能

文章聚焦GPU应用层面,通过实验对比不同同步代码实现的性能。在H20 GPU上测试,发现scope越小同步性能越好,内存屏障开销随scope增大而增加,还介绍非PTX及官方推荐实现方式并给出性能对比。

GiantPandaLLM
新闻资讯8

Karpathy:20年的编程生涯几周之内被颠覆,80%由AI来写,Claude和Codex跨过某种一致性门槛

OpenAI创始成员Andrej Karpathy分享用Claude编程心得,工作流从80%手动变为80%由AI完成,阐述AI编程优缺点、影响,还对行业未来提出疑问,认为2026年是充满能量的一年。

AI寒武纪
新闻资讯7

V4或Code要来?刚刚,DeepSeek-V3.1-Terminus发布!

DeepSeek线上模型升级为DeepSeek-V3.1-Terminus,单从名字看像是V3终极版,或在筹备V4及Code模型。deepseek - chat和deepseek - reasoner完成升级,此次更新改进语言一致性,优化Agent能力。

PaperAgent
开源动态8

Databricks开源限流方案,抛弃redis,性能提升10倍

Databricks 开源高性能限流系统设计,抛弃 Redis,通过内存分片和批量上报机制,实现 10 倍性能提升。还将限流算法改为令牌桶,解决了精度控制、在线迁移等问题,权衡了分布式一致性

AI工程化
产品应用7

SkyReels-Audio让嘴型和音频完美匹配不再难

音频驱动的动态人脸生成研究较少,昆仑万维提出SkyReels - Audio框架,基于预训练视频扩散变换器构建,支持无限长度视频生成与编辑,采用混合课程学习等策略,保障视频视觉保真度和时间一致性

带你学AI
算法论文8

少量视角也能得到完整3D几何,即插即用的语义增强重建插件来了

现有神经隐式路线在样本稀疏时有跨视角对应不稳等问题。上海交通大学等团队提出SERES,将跨视角语义一致性作先验注入模型,以低成本解决歧义问题,在多场景提升重建质量。

机器之心