视频扩散Transformer」共找到 1372 篇相关文章

新闻资讯7

“无限可能”AI视频竞演第二阶段结果揭晓,11部作品入围深圳路演大会

3月8日,“无限可能”AI视频竞演完成二阶段评审,11部作品从50部入围作品中选出,晋级3月14日深圳路演大会。作品经“幻镜”AI视听测评季第三季测评,结果将现场公布。

郎园Station
产品应用7

Gemini CLI 重磅更新:现已支持音视频处理,并带来多项体验升级

Gemini CLI 迎来重磅更新,带来多项改进。新增音视频输入(暂未正式开启)、增强 Markdown 功能,集成 VSCodium 和 Neovim,技术栈升级至 Ink 6 和 React 19,还有主题更新、隐私管理等优化。

AI寒武纪
新闻资讯7

直播预约 | Transformer 模型能否通过连接训练数据中的离散知识进行推理?

为研究Transformer是否具备组合式推理能力,提出FTCT合成任务。实验发现Few - shot CoT提示可激发推理能力,训练与测试相似度、模型复杂度影响推理能力。还分析了其内在机制,展示其泛化推理潜力。

深度学习自然语言处理
开源动态7

刚刚,马斯克开源基于 Grok 的 X 推荐算法:Transformer 接管亿级排序

X 工程团队宣布开源 X 推荐算法,该算法结合网络内外内容,用基于 Grok 的 Transformer 模型排名。马斯克曾在 2023 年开源部分算法,此次是近三年后再行动。算法开源或因平台此前分发机制受争议。

InfoQ
新闻资讯7

Anthropic封杀48小时,逼出OpenClaw最强反击!龙虾首次会生视频

Anthropic封杀OpenClaw免费接口,OpenClaw推出2026.4.5王炸更新,支持视频生成和‘睡眠记忆’系统,还优化提示词缓存。虽与Anthropic有波折,也反映开源项目依赖大厂模型的困境。

新智元
开源动态8

Identity-GRPO:阿里开源多人物定制化视频生成的后训练优化算法

阿里团队提出Identity - GRPO算法解决多人物视频生成身份一致性问题。构建约15000个标注样本数据集,基于Qwen2.5VL设计奖励模型,多项策略增强训练稳定性,实验验证性能提升显著。

PaperAgent
产品应用8

AI视频界变天!Decart发布实时“Sora”,直播/游戏业或遭降维打击

Decart创业公司推出全球首个实时、无限长度的AI视频模型MirageLSD,基于独创LSD技术。其响应低于40毫秒,靠历史增强等技术攻克难题。它不止用于特效,平台将持续升级,创始人目标是打造‘千亿级独角兽’。

AI工程化
算法论文8

如何判断AI视频真假?综述动态、可溯源、可解释的检测体系 | ACL26

AI视频生成技术发展快,现有检测方法难满足需求。新综述提出‘事实保真度验证’目标,梳理四层检测框架,涵盖底层线索、时空一致性等,强调多层证据耦合与可解释性,还分析评测指标与数据集。

新智元
新闻资讯7

The Information:OpenClaw 在中国AI圈的发酵和扩散速度,远超硅谷想象

The Information报道称,OpenClaw在中国AI圈发酵和扩散速度远超硅谷想象。字节、阿里、腾讯在云平台上线其服务,开发者可云端运行。围绕它的生态在中国疯狂生长,还渗透到硬件领域,对创业者是不可逆冲击。

Founder Park
算法论文8

英伟达、港大等发布创新KV缓存,实现扩散模型无训练加速

多数开源扩散语言模型推理效率不如自回归模型,英伟达、港大、麻省理工研究人员联合提出Fast - dLLM。它用近似KV缓存机制减少冗余计算,还提出基于置信度的平行解码策略,测试显示能加速且保持生成质量。

AIGC开放社区