「视频播客」共找到 1122 篇相关文章
黄仁勋做客美国第一播客:每天都在担心英伟达倒闭
英伟达CEO黄仁勋做客美国第一播客Joe Rogan,畅谈AI底层逻辑与技术演进,还分享英伟达创业历程。他指出AI已从检索转向推理,数据中心成“AI工厂”,并坦言每天担心公司倒闭。
Soul APP开源了一款高保真播客生成框架,90 分钟对话零崩盘!
Soul APP背后的Soul AI Lab发布开源项目SoulX - Podcast,是高保真推理框架,能生成90分钟以上连贯对话,有多方言切换等功能,或重塑语音内容产业生产方式。
从「找视频」到「产视频」:快手RaG推动推荐系统迈向完全生成时代
快手最新论文提出的 Recommendation-as-Generation(RaG),把推荐系统从「在已有视频里找答案」推进到「根据用户兴趣生成答案」,已在快手大规模广告系统中部署,带来广告收入提升。
xAI工程师播客聊太嗨,马斯克解雇了他
xAI工程师Sulaiman Ghori在播客上透露诸多公司内部细节,如MacroHard技术路线、算力部署方案等,后被解雇,引发网友猜测,其内容或为行业带来启发。
谷歌NotebookLM终于说中文了!这可是最火的大模型播客产品
NotebookLM正在变成谷歌AI路线里靠谱选手,现支持中文播报且将推移动App。它能将音频源转化为类似播客的对话,有摘要等功能,音频概览功能受欢迎,底层是谷歌Gemini 2.5 Flash,实用性强,即将上线安卓和iOS版App 。
马斯克视频生成模型首次交卷!电影级运镜+音效,免费可玩
xAI的“迄今为止最强大的视频音频生成模型”Grok Imagine 1.0正式全面上线。该模型支持文生视频、图生视频,音频效果出色,还擅长日常趣味创作。其在视频生成和剪辑性能领先,官网可免费玩。
Qwen深度研究一夜升级!可生成网页和音频播客,新模型能认医生手写体
Qwen版深度研究加速进化,增加听觉和视觉输出,可生成网页和音频。改进功能同时更新模型,Qwen3 VL能识别医生手写体。实测新功能表现出色,Qwen3-VL系列更新后性能优异。
登顶行业SOTA的多模态视频生成标杆,昆仑天工刚给开源了
昆仑天工发布的多模态视频生成模型SkyReels-V3正式开源。它能文生视频、图生视频等,效果逼真。该模型针对现有AI视频问题实现多方面技术突破,且昆仑天工在模型和产品层面均有深厚积累。
实测可灵O1,AI视频界的Banana也来了。
可灵推出全新多模态视频大模型可灵O1,融合多种视频生成与修改能力。实测显示,它能实现视频内容增删、特定内容修改、扣绿幕、动作迁移、风格更改等功能,虽有局限,但开启用嘴改视频新时代。
这个真人版《火影忍者》竟然是AI做的,来自中国AI视频新王者Vidu Q3
开年国产AI竞争激烈,AI视频生成圈新出全球首个支持16秒音视频直出的Vidu Q3。它能全自动生成,语言支持多语种,经权威认证排名中国第一、全球第二,可实现图生和文生音视频,提升了AI视频生成能力。