实时视频对话」共找到 1751 篇相关文章

产品应用8

豆包的新身份曝光:在国际艺术展当起了“AI讲解员”

文章讲述作者在浦东美术馆「AI与艺术」豆包讲解体验日活动的经历,实测豆包作为AI讲解员的业务水平,如筛重点、实时讲解、补知识,还揭秘其靠豆包大模型1.8的多模态处理等能力任职。

量子位
产品应用8

太逼真!豆包·播客模型来了:一句话生成「苏超联赛」播客,很懂13太保的梗

火山引擎发布豆包·播客模型,生成的AI对话语气、停顿等像真人。操作简单,生成快且有字幕。能处理多种类型内容,如热搜话题、苏超联赛、超长文本等。其基于端到端实时语音模型,有技术突破。

量子位
产品应用7

阿里首个世界模型:快乐…生蚝

刚成立一个月的阿里ATH事业群发布全球首个主动式实时交互世界模型HappyOyster(快乐生蚝),它搭载原生多模态架构,有漫游、导演、创造、分享等玩法,目前需邀请码体验。其技术突破让它区别于传统文生视频模型。

量子位
新闻资讯8

干货满载!腾讯云AI技术周圆满收官,回顾如何利用AI增效创收

2025腾讯全球数字生态大会启幕前夕,腾讯云联合InfoQ打造「AI技术周」,9月8 - 14日直播输出,围绕多关键议题邀大咖对话,公布多项AI+产品进展,涵盖降成本搭应用、AI Agent落地、数据库智能进化等内容。

InfoQ
算法论文8

通向世界模型关键一步:EX-4D来了,实现单目视频到自由视角生成

去年Sora等模型革新视频生成领域,相机可控的视频生成技术是构建世界模型核心。但从单视角生成极端视角视频是难题,PICO - MR团队提出EX - 4D,能从单目视频生成新视角视频,多方面表现出色。

机器之心
产品应用8

“参考生”之王回归:Vidu Q3持续进化,剧张力拉满|甲子光年

近期,AI视频公司生数科技的Vidu Q3正式上线参考生视频并全面升级。它能解决视频内容创作痛点,让爆款人设等稳定复现。在榜单上表现出色,经测试在多场景降本增效,提升了视频“剧张力”。

甲子光年
新闻资讯7

The Batch: 878 | Meta 与 OpenAI 加强防护措施

随着未成年人使用聊天机器人的不良互动受关注,Meta 和 OpenAI 承诺加强管控。Meta 将更新聊天机器人,避免不当对话;OpenAI 要推家长控制功能。此前两家公司均因相关问题遭批评。

DeeplearningAI
开源动态8

腾讯混元开源游戏AI生成新工具!RTX 4090就能制作3A级动态内容

腾讯开源游戏视频生成框架Hunyuan - GameCraft,基于混元视频生成搭建,操作简单,输入单张场景图、文字描述和动作指令就能生成高清动态游戏视频,解决传统工具瓶颈,性能优于主流模型。

量子位
新闻资讯7

夸克做ChatBot,为什么是现在?

AI行业曾有“垂直Agent幻觉”误区,重演App时代“功能碎片化”老路。而模型趋势是泛化与整合。10月23日夸克上线“对话助手”,其此时入局是基于技术、竞争和交互形态三重判断,且有模型和系统双重保障。

乱翻书
算法论文7

InfiniteTalk:音频驱动的从口型到全身动作同步方法

近年来视频AIGC推动音频驱动人体动画变革,但传统视频配音局限口部。中国科学院大学提出稀疏帧视频配音范式,推出InfiniteTalk生成器,结合多种技术实现全身动作与音频同步,实验表现突出。

带你学AI