视频扩散技术」共找到 3750 篇相关文章

新闻资讯7

“无限可能”AI视频竞演第二阶段结果揭晓,11部作品入围深圳路演大会

3月8日,“无限可能”AI视频竞演完成二阶段评审,11部作品从50部入围作品中选出,晋级3月14日深圳路演大会。作品经“幻镜”AI视听测评季第三季测评,结果将现场公布。

郎园Station
产品应用8

一场对话,我们细扒了下文心大模型背后的技术

信通院大模型推理能力评估中,文心X1 Turbo获最高级“4+级”。百度AI Day上,副总裁吴甜解析文心4.5 Turbo和文心X1 Turbo,从多模态、深度思考等方面介绍技术,还展示其在多场景应用成果。

量子位
产品应用7

别再让语音机器人“答非所问”:AI Force任务型语音对话技术总结

本文围绕企业级任务型语音Agent核心挑战,提出解决“拟人化”与“专业化”问题。介绍三段式语音对话解法、架构演进,还提及‘衍算’推理框架等技术及未来方向,团队来自蚂蚁集团AI force。

阿里云开发者
算法论文8

ICML 2025|趣丸研发新型人脸动画技术,声音+指令精准控制表情

广州趣丸科技团队提出新颖肖像驱动框架Playmate,能根据音频和控制条件生成高质量肖像视频,精准控制表情和姿态。成果被ICML 2025收录,代码开源筹备中,在多方面优于现有方法。

机器之心
新闻资讯7

Anthropic封杀48小时,逼出OpenClaw最强反击!龙虾首次会生视频

Anthropic封杀OpenClaw免费接口,OpenClaw推出2026.4.5王炸更新,支持视频生成和‘睡眠记忆’系统,还优化提示词缓存。虽与Anthropic有波折,也反映开源项目依赖大厂模型的困境。

新智元
开源动态8

Identity-GRPO:阿里开源多人物定制化视频生成的后训练优化算法

阿里团队提出Identity - GRPO算法解决多人物视频生成身份一致性问题。构建约15000个标注样本数据集,基于Qwen2.5VL设计奖励模型,多项策略增强训练稳定性,实验验证性能提升显著。

PaperAgent
新闻资讯7

Claude强到不敢发的Mythos,被质疑用了字节Seed技术

Claude最强“神话”模型Mythos引发猜测,或用了字节Seed技术。社区热议其是否采用循环语言模型架构,关键线索来自Anthropic测试数据,在图搜索测试中Mythos优势明显,还有其他线索指向循环架构。

量子位
算法论文8

如何判断AI视频真假?综述动态、可溯源、可解释的检测体系 | ACL26

AI视频生成技术发展快,现有检测方法难满足需求。新综述提出‘事实保真度验证’目标,梳理四层检测框架,涵盖底层线索、时空一致性等,强调多层证据耦合与可解释性,还分析评测指标与数据集。

新智元
产品应用7

国民技术发布面向AI数据中心的3 kW数字电源参考设计方案

在AI算力增长与能源转型驱动下,电力供给变革。国民技术发布面向AI数据中心的3 kW数字电源参考设计方案NS3KW53V5P2L3,基于N32H474芯片和Hunter OS生态,有高转换效率等优势。

芯师爷
新闻资讯7

The Information:OpenClaw 在中国AI圈的发酵和扩散速度,远超硅谷想象

The Information报道称,OpenClaw在中国AI圈发酵和扩散速度远超硅谷想象。字节、阿里、腾讯在云平台上线其服务,开发者可云端运行。围绕它的生态在中国疯狂生长,还渗透到硬件领域,对创业者是不可逆冲击。

Founder Park