超低延迟」共找到 3024 篇相关文章

开源动态8

完全离线!开源实时语音识别神器,本地实时语音转文字,秒级延迟+说话人识别!

实时语音转文字和说话人识别需求渐长,但传统工具多依赖云端,有隐私与延迟问题。GitHub上的开源项目WhisperLiveKit是本地化语音识别方案,速度快、延迟、支持说话人识别,适合会议等场景。

开源星探
产品应用8

大神Karpathy都投的AI实时视频生成模型:直播都能立即转,无限时长几乎零延迟

AI初创公司Decart推出首个零延迟无限实时视频生成的AI模型MirageLSD,大神Karpathy都投资了。它能实时生成视频流,无时长限制且延迟至40毫秒以下,还攻克了传统模型‘误差累积’难题。

量子位
开源动态8

下载量 1300 万,昇思 MindSpore:AI 框架迈入“节点时代”

开源五周年,昇思 MindSpore 成绩亮眼,下载量 1300 万。它完善大模型、部署、科学计算等核心能力,还提出 HyperParallel 架构应对新挑战,正式版及套件明年上半年发布,未来社区将多方向推进。

AI前线
开源动态8

数据减少千倍,500 美金就可训练一流视频模型,港城、华为Pusa来了

香港城市大学与华为香港研究所合作推出 Pusa 项目,它基于 FVDM 理论,可极成本微调大规模预训练视频模型,成本降 200 倍、数据减少 2500 倍,代码已开源。

机器之心
产品应用8

单机狂飙4万亿参数,国产AI「四大天王」首次合体!这台节点鲨疯了

国产「四大开源天王」可在单机运行,背后是「元脑SD200」节点。它有大显存、高速互联域和强算力,支持64路本土GPU且可商用。浪潮信息以开源为战略加速大模型商业化落地。

新智元
算法论文8

国产芯片比英伟达整体效率更高!?华为 CloudMatrix384 节点首曝论文,跑 DeepSeek 效率越英伟达

今年4月,网上曾争论华为芯片效率是否国际主流。近日华为团队论文公开,阐述在CloudMatrix 384节点部署DeepSeek大模型细节,性能指标英伟达体系,还介绍架构、软件栈及适配优化方案。

InfoQ
产品应用8

Qwen3-Embedding 全揭秘:从技术到服务,打造高效AI产品的关键路径

文章全面揭秘 Qwen3-Embedding,介绍其核心原理、优势、应用场景。还给出在 PAI 和百炼平台的使用方法,含部署、推理、微调等。通过对比实验,凸显其延迟成本特点,未来将成语义理解核心设施。

阿里云开发者
产品应用8

华为云再掀算力风暴:CloudMatrix384节点将升级,Tokens服务性能最大可H20四倍

华为云在全联接大会2025发布新进展,如CloudMatrix节点升级、首创EMS服务等。其以“算力黑土地”理念,用智算+通算策略满足产业需求,Tokens服务优势显著,还支撑多领域应用。

量子位
新闻资讯7

Salesforce 最新研究:LLM 智能体 CRM 测试成功率至 35%,保密意识还,企业敢用吗?

Salesforce AI 研究团队新基准测试显示,LLM 智能体在 CRM 测试中表现欠佳,单步任务成功率约 58%,多步任务降至 35%,且保密意识,与企业需求差距大。

InfoQ
推荐文章7

一起聊聊Nvidia Blackwell新特性之比特GEMM

本文是NVIDIA Blackwell架构GEMM研究系列文章第三部分,介绍精度计算,探讨Blackwell GEMM如何执行,关注6位和4位格式及对内存布局影响。还提及精度优势、数据格式、UMMA实现、操作限制、CUTLASS抽象方式等。

GiantPandaLLM