开源动态8
Smart Turn:8M模型语音停顿检测仅12ms
AI工程化
AI 摘要
Smart Turn语音停顿检测模型很牛,v3.1版新增数据集让英语识别准确率从88.3%升至95.6%,推理快至2毫秒,8MB小身材性能强,还在HuggingFace开源。
阅读原文 · AI工程化
12ms!一个仅8M的语音停顿检测模型
语音助手准确判断用户是否说完是挑战,Smart Turn将决策过程缩至12毫秒。其v3.1版有改进,新增数据集提升英语识别准确率,推出未量化版本推理更快,8MB模型性能优,已在HuggingFace开源。

关注公众号
扫码关注
第一时间收到每日精选
相关文章
新闻资讯7
Codex负责人:Codex两三月后将过时
Codex负责人称两三个月后Codex将过时,因下一代模型要处理大规模并发Agent,非其能应对。Huggingface实验显示大小模型在不同harness下排名差异大,脱离模型谈harness过时或不适配说模型Agent能力都不妥。
探索AGI
开源动态8
HuggingFace联合开源机器人学习教程及资源库
HuggingFace与牛津大学研究者推出机器人学习教程,附带开源数据集、模型等的LeRobot库。教程从经典机器人学讲起,介绍强化、模仿学习及通用策略,还提及解决现实瓶颈的技术与前沿模型。
机器之心
开源动态7
马斯克开源Grok 2.5,称中国公司是劲敌
马斯克主导xAI正式开源Grok 2.5,Grok 3将半年后开源。Grok可在HuggingFace下载,运行有条件。虽Grok 2曾有不错表现,但网友对其参数权重、开源协议等有诟病。此外,还更新APP视频生成功能,马斯克称中国公司是xAI最大对手。
量子位
开源动态8
微软:Agent革新代码评测基准
长期以来主流代码修复评测基准SWE - bench问题多,制约AI模型能力展现。微软发布SWE - bench - Live,引入新Issue,实现环境自动化构建与更新,打破传统局限,还揭示传统基准过拟合问题。
量子位