「语音Agents」共找到 2881 篇相关文章
为什么你的 Agent 总是出故障?从算力基建到可信熔断的架构生死线 | 直播预告
本次直播集结值得买、商汤、明略三位技术专家,拆解可信 Agent 构建之道。将探讨大模型基础设施、可信 Agent 架构、MCP 协议实战等问题,还会解答观众提问。
英伟达开源上瘾了!推出了一款实时语音智能体的终极 ASR:24ms 极速锁定。
英伟达开源了Nemotron Speech ASR模型,它是低延迟、实时流式语音识别模型,单句转录锁定仅需24毫秒。其核心能力包括缓存感知、运行效率高、动态运行灵活,还被放进完整语音智能体方案。
AICon 2025 深圳回顾:AI Agent 爆火全场,管理与推理优化成新焦点
2025年8月22 - 23日,AICon全球人工智能开发与应用大会在深圳落幕。70+嘉宾、800+开发者与企业代表参会,议题覆盖AI Agent、推理优化等。AI Agent成全场焦点,企业管理议题意外走红,展示了AI深入各领域的趋势。
Agent Team 实践与架构设计:在约束下构建可演进的一个人开发团队
作者结合构建的Routa,探讨在Token、流程、工具选择等约束下构建可演进的多Agent系统。介绍了Routa架构、原则,如跨Agent通信、状态外置等,还阐述了各设计要点及示例,强调系统可演进性。
NeurIPS 2025 | 蚂蚁CGM:图融合架构重塑代码大模型,探索非 Agent 新范式
在NeurIPS 2025上,蚂蚁将展示Code Graph Model (CGM)。它把代码库图结构集成到开源LLM,开启新范式,在代码库级任务上以非Agent方案登顶开放权重模型榜首,解决了复杂软件工程的Agent依赖难题。
红杉中国推出 Agent 基准测试「xbench」,双轨评估体系,关注 AI 真实场景的效用
红杉中国开放AI和Agent基准测试工具「xbench」,采用双轨评估体系,构建多维度测评数据集。首期发布两个核心评估集并排名,提出垂类Agent评测方法论。该工具旨在解决现有评估问题,关注AI真实场景效用。
Speech LLM 的下一个突破口:你的语音大模型可以是个「带韵律的文本模型」
语音大模型存在‘模态代沟’致性能‘降智’,此前两波改进未根本解决。香港中文大学论文提出TextPro - SLM架构,从输入端破局,仅用约1000小时数据就实现低‘模态代沟’,对多模态模型设计有启发。
Cherry Studio 复盘:从 Chat 到 Agent,一款「套壳」开源产品如何推倒重来?
Cherry Studio最初是为用户在不同大模型间切换的聊天客户端,随行业从Chat转向Agent,它开启2.0版本重构,定位转向「个人Agent平台」,底层架构重写,要解决产品复杂性、完善协作等问题。
深度解析大模型技术演进脉络:RAG、Agent与多模态的实战经验与未来图景
大模型作为产业变革核心引擎,RAG、Agent与多模态技术重塑AI与现实交互边界。本文解析技术演进脉络、实战经验与未来图景,介绍三者在各领域应用及面临挑战,为产业升级提供指引。
Notion、Stripe 都在用的 Agent 监控,Braintrust 会是 AI-native 的 Datadog 吗?
当 Agent 迈向产品化,开发者面临观测、评估和优化黑箱系统的挑战。Braintrust 由 Ankur Goyal 于 2023 年创立,重塑 Observability,提供 Eval 和 Ship 模块,获多家头部公司青睐与投资。文章从多方面剖析其能否成 Agent 时代‘新 Datadog’。