「智能语音客服系统」共找到 3632 篇相关文章
Meta发布40页报告,具身智能的下一步是「心智世界模型」:能听,能看,能理解,会共情
Meta发布40页报告,首次将对人心智状态的推断概念化为心智世界模型,与物理世界模型实现“双轨建模”。还指出要结合系统A和B让AI自主学习,心智世界模型在多智能体协作潜力大。
上海 AI Lab 庞江淼:开放平台是具身智能“ChatGPT 时刻”的前提|具身先锋十人谈
上海AI Lab庞江淼认为开放平台是具身智能“ChatGPT时刻”的前提。他早期专注CV,后转型切入底层控制。他指出具身智能Scaling Law非简单线性,还探讨了大小脑融合、VLA技术等,团队发布的Intern - Robotics目标是建开放基础设施。
AI能帮忙厨房看火了!面壁智能开源全模态模型MiniCPM-o4.5,边看边听还能主动抢答
面壁智能开源全模态模型MiniCPM-o4.5,能边看边听还主动抢答。它引入全双工多模态实时流机制,在多方向达全模态模型领先水平。该模型是端侧原生,将与开发板配套,助力端侧智能硬件开发。
阿里 Qwen3-TTS 全新上线!支持9种方言+49种音色,连天津味儿都拿捏了!
阿里通义团队上新 Qwen3-TTS 文本转语音模型,主打拟人语音表达、丰富音色体系与多语言多方言能力。有 49 种高保真音色,支持 10 种语言、9 种方言,还能智能调节语速和韵律。
从Token到词元:全模态时代的基模与交互入口
2026年3月24日国家数据局确立“词元”为Token标准译名,Token生成与消耗方式在多模态场景正发生变化。模思智能获数亿融资,探索从语音到全模态的路径,成果颇丰且完成能力闭环,其发展受关注。
比豆包手机还狠!Gemini电视登场CES,谷歌打响客厅革命第一枪
2026年CES上科技新品频出,谷歌将Gemini AI引入Google TV,让电视具备自然语言内容发现与推荐、教育深度学习等功能,还增强语音控制能力,打响客厅AI革命第一枪,同时涂鸦智能展示了AI生活助手等产品。
Artificial Analysis 发布 2025 年 AI 现状 Q3 季报
Artificial Analysis发布2025年Q3 AI现状报告,揭示五大关键趋势,如推理模型占智能榜单前十、智能体能力突破、开源模型发布创新高、图像视频技术主流化、原生语音模型达生产级,还将举办简报会。
理想首款AI眼镜,只卖1699元
理想推出首款AI眼镜Livis,售价1699元起,整备重仅36g,续航18小时。它能控车、有头枕音响,还可拍照录像。采用流式智能语音框架,核心亮点是理想同学语音助手,意在构建以车为核心的AI生态。
cursor 2.0实测:cursor的摆烂之作
作者实测Cursor 2.0后大失所望。它交互粗糙,多智能体虽有多个回答但选方案操作不明;因Claude涨价推出智能分发和自研Composer,后者除快无优势且需魔法;内置浏览器交互麻烦,窗口管理离谱,语音模式基本不可用。
从私域知识到智能 Agent:构建智能运维知识库
抖音算法工程师王宁在 QCon 大会分享,介绍将私域知识与 LLM 融合构建运维系统的方法,详解 SOPAgent 架构解决传统 AIOps 难题,还提及多模态数据处理、知识管理体系等亮点。