「语音智能体」共找到 3632 篇相关文章
具身智能威胁分析的分层方法和全景图
文章指出具身人工智能应用广泛,安全需求迫切,但现有研究鲜少涉及具身化场景。复旦大学等组织分析400多篇论文,提出具身智能威胁分析全景,介绍各层攻击方法、危害及防护措施。
清华许华哲:具身智能需要从 ImageNet 做起吗?
清华许华哲探讨具身智能,分析其爆发原因、失败模式及决策点,涉及视觉信号输入、触觉应用、学习方法等,还探讨具身智能是否需‘ImageNet时刻’,并从宏观视角谈智能的共性。
突破泛化瓶颈:阿里云智能运维 Agent 评测体系实践
大模型 Agent 在智能运维场景落地常遇泛化难题。阿里云李也博士介绍利用评测集验证和提升智能运维算法泛化性的实践,阐述评测集重要性、构建方法,还展示其在提升智能运维 Agent 能力上的成效。
Meta宣布AI研究架构调整,成立TBD Lab,取消AGI Foundations团队,强化超级智能战略
Meta进行AI研究架构大重组,将业务分为研究、训练、产品和基础设施四个团队。成立TBD Lab探索新方向,如构建‘omni’模型;FAIR成创新引擎;解散AGI Foundations团队。旨在强化超级智能战略。
新型开源端到端 AI 语音模型!Voila:195ms 超低延迟引领全双工对话!
Maitrix团队发布开源AI端到端语音模型Voila,以195ms超低延迟及全双工对话受关注。它功能强大,支持多语言,有多种使用方式,适用于多个场景,架构采用模块化设计。
社区供稿 | 开源SOTA:阶跃发布端到端语音大模型Step-Audio 2 mini!
阶跃星辰发布最强开源端到端语音大模型 Step - Audio 2 mini,在多个国际基准测试集获 SOTA 成绩。它统一建模语音理解等,率先支持语音原生 Tool Calling 能力,架构创新,案例展示其多方面强大能力。
突发!微软与OpenAI同日开火:语音之战+通用大模型,AI霸权决战打响
OpenAI发布语音大模型时,微软同日推出自研语音模型MAI-Voice-1和通用模型MAI-1-preview。MAI-Voice-1效率高、表达丰富,MAI-1-preview采用MoE架构。微软此举在语音战场布局,也为与OpenAI谈判增加筹码。
多模态文本智能白皮书发布!5大能力标准、11个行业案例全解析(附下载)
合合信息发布《文本价值觉醒,赋能智能决策——多模态大模型文本智能白皮书(2026)》,提出复杂文本智能五大核心能力标准,还通过11个真实行业标杆案例展示技术如何转化文档为决策力。
中国电信天翼AI发布首款AI眼镜,星辰大模型开启第一视角智能交互新时代
在2025世界人工智能大会上,中国电信天翼AI发布全球首款融合自研“星辰大模型”的智能穿戴设备——天翼AI智能眼镜,依托云网融合与星辰大模型,开创第一视角智能交互新范式。
李想重画具身智能
理想汽车在成立的十一年里,擅长将复杂技术与家庭出行需求对齐。2026年,理想不再满足于打造更好的家庭车,提出造能感知、思考、行动、反馈的硅基生命体。李想提出具身智能上下半场论,理想重构研发体系,以造人方式造车。