播客场景」共找到 188 篇相关文章

新闻资讯8

黄仁勋做客美国第一客:每天都在担心英伟达倒闭

英伟达CEO黄仁勋做客美国第一客Joe Rogan,畅谈AI底层逻辑与技术演进,还分享英伟达创业历程。他指出AI已从检索转向推理,数据中心成“AI工厂”,并坦言每天担心公司倒闭。

量子位
开源动态8

Soul APP开源了一款高保真客生成框架,90 分钟对话零崩盘!

Soul APP背后的Soul AI Lab发布开源项目SoulX - Podcast,是高保真推理框架,能生成90分钟以上连贯对话,有多方言切换等功能,或重塑语音内容产业生产方式。

开源星探
新闻资讯8

谷歌NotebookLM终于说中文了!这可是最火的大模型客产品

NotebookLM正在变成谷歌AI路线里靠谱选手,现支持中文报且将推移动App。它能将音频源转化为类似客的对话,有摘要等功能,音频概览功能受欢迎,底层是谷歌Gemini 2.5 Flash,实用性强,即将上线安卓和iOS版App 。

机器之心
产品应用8

字节扣子空间上新一键转客功能,现在我们真成同事了|甲子光年

5月27日,字节跳动旗下AI协同办公平台扣子空间新增客功能。其客音频生成功能让AI从‘说什么’跨越到‘怎么说’,适用于多场。扣子空间还具备跨模态协作等能力,引入MCP协议,免费开放核心功能。

甲子光年
产品应用7

Qwen深度研究一夜升级!可生成网页和音频客,新模型能认医生手写体

Qwen版深度研究加速进化,增加听觉和视觉输出,可生成网页和音频。改进功能同时更新模型,Qwen3 VL能识别医生手写体。实测新功能表现出色,Qwen3-VL系列更新后性能优异。

量子位
开源动态8

视频生成比放还快:开源VDN-H3,14秒视频11秒搞定

近期,网络出现“无限流”视频,源于MiniMax H3。OpenVDN团队开源Video Delta Net(VDN),基于MiniMax H3使视频生成速度提升75到90倍,14.4秒的768p视频11.23秒就能生成。它采用混合思路,性能提升显著。

AI工程化
算法论文8

VLA模型为何忽视语言?破解指令跟随幻觉,分布外场泛化新突破

当前VLA模型常依赖视觉线索而非语言指令,导致新场表现不佳。论文提出LangForce方法,引入对数似然比损失,强化模型对语言的依赖,提升分布外泛化能力,还保留语言核心功能。

新智元
推荐文章7

客手记 01 | 极睿武彬:创业就是,我愿意过刀尖舔血的生活

本文讲述极睿科技武彬的创业历程。早期获融资后业务方向错误致公司濒临绝境,后转型对接传统商家获黄峥融资。疫情时他转型销售挽救公司,还成“网红”提升获客效率,他认为创业要回归商业本质。

AI科技评论
产品应用7

HTML正在成为 AI 办公的新载体?WorkBuddy 升级了一个关键能力

WorkBuddy升级“资料库”功能,普通用户不用写代码,用自然语言就能生成、编辑和发布HTML页面。用户能做书影音地图、客可视化网站等,HTML可人机协同编辑,还能实现知识沉淀。

AI科技评论
开源动态8

轻量级语音模型Vui开源,支持本地部署,笑声停顿全拟真,4万小时练出人类对话感!

近日,Fluxions - AI团队在GitHub开源轻量级语音模型Vui,可设备端运行。它能精准模拟语气词、笑声等,有三款模型,适用于语音助手、客生成等场,解决了传统模型的痛点。

开源星探