扩散强制」共找到 286 篇相关文章

算法论文8

盛大AI研究院新作:流式生成超越非流式,一句话让虚拟人动作丝滑如真,推理延迟仅1帧

盛大AI研究院与东京大学联合提出FloodDiffusion,首个基于定制化扩散强制的流式人体动作生成框架。它能零延迟生成无限长动作序列,解决了现有方法的问题,在多数据集评估中表现优异。

量子位
算法论文7

BLIP3-o统一图像生成与理解,多模态融合趋势显现

BLIP3 - o致力于统一图像理解和生成、提升生成质量和效率。它融合自回归与扩散模型,采用CLIP + Flow Matching架构等技术亮点。经训练,在图像理解和生成任务表现出色,指令微调效果显著。

CourseAI
开源动态8

ViT一作盛赞:这个中国开源“PS模型”强过Nano Banana

ViT核心作者Lucas Beyer连发三条帖子怒赞通义千问发布的开源模型Qwen—Image—Layered,认为这是图像生成的正确打开方式。该模型可实现PS级拆图自由,支持精细化修改图片元素,核心技术是端到端的扩散模型。

量子位
开源动态7

爆火「开源投资框架」,AI时代的伯克希尔

AI投资虽火但常给出正确废话,AI Berkshire爆火,兼容Claude Code和OpenAI Codex,有18个Skill。它将四位投资大师方法论抽象成流程,通过多Agent协作完成投研闭环,还有强制给结论等特点。

开源AI项目落地
开源动态8

告别Transformer!北大、北邮、华为开源纯卷积DiC:3x3卷积实现SOTA性能,比DiT快5倍!

北大、北邮和华为研究提出纯卷积扩散模型 DiC,抛弃自注意力机制回归 3x3 卷积。它性能超 DiT,推理速度快 5 倍,证明精心设计的卷积网络在生成任务中也能表现卓越。

机器之心
算法论文8

UNC | 发布Bifrost-1,构建“最强大脑”与“顶级画师”的桥梁,低成本实现“文生图”自由

随着AI发展,打造能推理又能创作的系统成为焦点。但让LLM学习视觉创作面临训练成本高和能力受损问题。BIFROST - 1框架在MLLM和扩散模型间建通信信道,解决核心痛点,实验表现出色。

AINLPer
新闻资讯7

田渊栋被Meta卸磨杀驴,但全网疯狂发offer!OpenAI冲来抢人了

Meta裁员风暴扩散,FAIR研究科学家田渊栋等被裁。田渊栋入职十年多,成果亮眼,却在协助处理Llama 4相关事务后被裁。此外,不少刚入职的博士也遭殃。同时,Meta还用AI取代人工审核。

新智元
开源动态7

MIDAS:快手可灵发布实时交互式数字人生成框架

近年来交互式数字人视频生成受关注,但实时处理多模态输入有挑战。快手可灵团队提出MIDAS框架,基于LLM驱动的自回归模型,结合轻量级扩散头,实现低延迟、交互式多模态控制,还构建大规模数据集等。

带你学AI
新闻资讯7

GPT-5 的秘密武器:Universal Verifiers

OpenAI开发「Universal Verifier」(通用验证器)技术助力GPT - 5。该技术让一个AI模型检查另一个模型输出质量,解决了强化学习难题,使GPT - 5在多领域表现出色,不过技术可能因人员流动扩散

AGI Hunt
新闻资讯7

讲习班日程公布|第四届全国大模型智能生成大会(LMG 2025)

第四届全国大模型智能生成大会(LMG 2025)11月1 - 3日在成都召开,预计超千人参会。11月3日的讲习班邀请四位青年专家,围绕AI基础设施、扩散语言模型等前沿议题,分享技术进展与实战经验。

深度学习自然语言处理