音频加速识别」共找到 974 篇相关文章

推荐文章7

过时的 Python 版本会让公司损失数百万美元

JetBrains报告显示83%的Python开发者用旧版本,这不仅是技术债务问题,还会增加云账单成本。Python新版本有显著性能提升,升级能节省成本,容器化也未加速升级。

InfoQ
产品应用8

Claude封锁中国,腾讯带着国产AI编程工具CodeBuddy来了

Claude封锁中国背景下,国产代码模型加速发力。腾讯CodeBuddy上线,其IDE和CLI有新特性。InfoQ采访团队,探讨定位、技术等思考,国产模型与工具、生态形成“模型—工具—生态”链路。

InfoQ
开源动态8

腾讯重磅开源!端到端视频音效生成模型HunyuanVideo-Foley

腾讯混元正式开源端到端视频音效生成模型 HunyuanVideo-Foley,适用于多场景。它采用新型框架结合 REPA 策略,有三大核心优势,能适配多种场景,抑制底噪,保证音频保真度。

带你学AI
算法论文8

杜克大学、Zoom推出LiveMCP‑101:GPT‑5表现最佳但未破60%,闭源模型Token效率对数规律引关注

杜克大学与Zoom研究者推出LiveMCP - 101,这是针对真实动态环境的MCP - enabled Agent评测基准。含101个任务,实验显示先进模型成功率低于60%,研究为提升Agent能力提供改进方向。

机器之心
算法论文8

EMNLP25 | "大模型在环"技术新突破:Dial-In LLM 推动中文客服意图聚类新范式

本文提出LLM-in-the-loop意图聚类框架,以传统聚类为骨架,微调后的中文LLM做语义裁判和命名批注。在10万+真实客服通话数据集上超越基线,解决现有方法依赖词向量、缺乏可解释性、调用大模型成本高的问题。

深度学习自然语言处理
新闻资讯7

GitHub独立时代落幕!CEO离职创业,微软全面接管

GitHub CEO Thomas Dohmke辞职创业,微软不再任命新CEO,将其完全并入今年1月成立的CoreAI部门。此前GitHub被微软收购后保持相对独立,此次变动标志其独立时代结束。

量子位
新闻资讯8

谷歌深夜放出「创世引擎」Genie 3!一句话秒生宇宙,终极模拟器觉醒

谷歌DeepMind推出通用世界模型Genie 3,能以每秒20 - 24帧速度实时生成720p画面,一句话即可生成动态世界,可模拟物理、自然等多种场景,但也存在有限动作空间等局限。

新智元
开源动态8

科学智能2.0的「最强大脑」!上智院复旦无限光年联合发布开放平台

WAIC 2025上,上海科学智能研究院、复旦大学、无限光年联合发布「星河启智科学智能开放平台」。它以六大核心能力打造科学智能生态、驱动科研范式变革,致力于实现「科学的AI次方」效应。

新智元
新闻资讯7

硅谷AI初创重新拥抱996

AI创业高潮下,硅谷初创公司竞相采用996模式,甚至沿用其名追赶中国。虽有公司提供福利,但遭部分人声讨,有人认为制造风险、透支生活,也有人觉得报酬可观。

量子位
算法论文8

DeepSeek推理最高提速6倍!开源研究:加装「思维进度条」,计算量减少30%

特拉维夫大学团队开发新方法,给LLM推理任务装进度条,控制推理深度和速度。提出“思维进度向量”TPV预测推理位置,干预TPV可“超频”“降频”,模型已在GitHub开源。

量子位