算法论文7
阿里新模型让音频驱动肖像更自然
带你学AI
AI 摘要
阿里:为解决音频驱动肖像动画现有问题,提出Talking - Critic奖励模型和TLPO优化框架,构建Talking - NSQ数据集,经实验在多维度表现超现有SOTA方法。
阅读原文 · 带你学AI
Talking-Critic奖励模型带来更自然的音频驱动肖像
近期音频驱动肖像动画技术发展快,但现有方法存在嘴型声音不对、动作不自然等问题。阿里提出Talking - Critic奖励模型,构建Talking - NSQ数据集,还提出TLPO优化框架,提升多维度表现,实验超现有SOTA方法。

关注公众号
扫码关注
第一时间收到每日精选
相关文章
产品应用8
阿里发布Qwen3.8,编程16天造出智能体
8月3日,阿里发布新一代基座大模型Qwen3.8,总参数量2.4万亿,编程和办公能力提升,在权威榜单中表现出色。其API已上线,价格有优势。‘千问办公’公测,Qwen3.8性能强大,还适配阿里真武M890超节点。
InfoQ
产品应用8
阿里Qwen3.8-Max发布,性能强价格优
阿里巴巴突袭发布新一代基座大模型Qwen3.8 - Max,它总参数量达2.4万亿,在多场景表现出色,在权威榜单冲进全球第一梯队,性能直逼Claude,且价格实惠,实测反馈良好。
量子位
产品应用8
阿里发布Qwen3.8,编程办公能力超强
8月3日,阿里巴巴发布新一代基座大模型Qwen3.8,总参数量2.4万亿,性能居全球第一梯队。其API已上线千问AI平台,还接入“千问办公”。Qwen3.8编程和办公能力强,还将开源,性价比高。
AI前线
产品应用8
阿里语音模型支持100小时直播,离线版全球第一
阿里升级实时语音识别大模型Fun-ASR-Realtime,首字延迟在百毫秒级别、识别准确率接近离线模型。在影视飓风100小时直播中表现出色,还支持16种方言和30种语言,离线模型Fun-ASR-Flash全球权威榜单排第一。
千问大模型