视频播客」共找到 1125 篇相关文章

产品应用7

全新唇同步技术OmniSync,遮挡,侧脸不在话下

唇同步对创建逼真视频内容很重要,但现有方法在身份一致、姿势变化等方面有局限。中国人大携手快手提出OmniSync,引入无需掩膜的训练范式,保证身份和姿态一致,能适应复杂场景,还建立AIGC - LipSync基准。

带你学AI
算法论文8

7B打败o3、GPT-5!医学AI智能体让模型学会“看哪里、怎么看”

上海创智学院LeapQuest团队联合多校,在ICML 2026接收两篇论文,提出“Think with Images/Think with Videos”范式,让视觉证据参与模型推理,Ophiuchus和MedScope分别用于图像和视频诊断,表现出色。

量子位
新闻资讯8

内容娱乐新风向:这群创业者靠多模态 AI 玩出了新花样

12月23日,「MASHANG DEMO TO DAILY」第二期活动在杭州开启,展示多模态AI探索成果。6位创业者分享精华内容,涉及游戏开发、虚拟社区、视频创作等领域,探讨多模态AI产品价值与发展方向。

特工宇宙
新闻资讯7

中国机器人手机火爆MWC!老外快门按得根本停不下来

2026年MWC巴展上,荣耀推出的机器人手机Robot Phone引发关注。它有外接云台摄像头,能全角度AI视频通话、互动拍摄,还可结合旗下人形机器人联动。其结构压缩,AI能力强,打开了手机设计新思路。

量子位
算法论文8

SIGGRAPH Asia 2025|30FPS普通相机恢复200FPS细节,4D重建方案来了

3D视觉领域难题是用普通摄像机将高速世界转为数字化4D时空。受限于成本和带宽,现有方法有局限。本文提出“异步采集 + 视频扩散模型修复”方案,用30 FPS相机恢复100 - 200 FPS动态细节。

机器之心
算法论文8

告别噪声初始化:NTU MARS Lab提出A2A新范式,实现机器人高性能单步动作生成

新加坡南洋理工大学 MARS Lab 提出 Action-to-Action (A2A) Flow Matching 新范式,以历史机器人轨迹为生成起点,打破生成速度与精度瓶颈,在训练效率、推理速度及泛化表现上佳,还可扩展至视频生成领域。

机器之心
开源动态8

SIGGRAPH Asia 2025|电影级运镜一键克隆!港中文&快手可灵团队发布CamCloneMaster

香港中文大学与快手可灵团队联合提出运镜可控视频生成框架CamCloneMaster,引入‘参考即用’范式,告别对相机参数依赖。其训练、测试代码和数据集均已开源,在各项指标上优于SOTA方法。

机器之心
新闻资讯7

登上热搜!Prompt不再是AI重点,新热点是Context Engineering

最近「上下文工程」很火,Andrej Karpathy 为其打 Call。它和「提示词工程」不同,是构建自动化系统给模型提供输入。文章介绍了其核心要素、实践方法论,还给出了参考的博视频

机器之心
推荐文章8

第三个软件黄金时代来了!软件工程宗师、70 岁 UML 之父发声:AI 自动化被严重夸大,Dario Amodei 又越界了

软件工程宗师、UML 之父 Grady Booch 在分享对计算领域三次‘黄金时代’理解,直言 Anthropic CEO Dario Amodei‘软件工程将 12 个月内自动化’判断错误,强调工具虽变但软件工程难题未消失。

InfoQ
产品应用7

我是如何破解 NotebookLM 系统提示词的?

作者分享通过“逆向推理”破解NotebookLM系统提示词的故事,介绍系统提示词概念、破解原因、策略及从音频逆推提示词的方法,还提到该方法的效果及局限性 。

宝玉AI