超低延迟」共找到 3024 篇相关文章

新闻资讯8

硅谷热议:最快语音转文字模型

AI语音独角兽ElevenLabs发布Scribe v2 Realtime实时语音转文本模型,实现150毫秒超低延迟、93.5%高准确率,覆盖90多种语言,打破速度与精度不可兼得困境,此前该领域痛点多。

量子位
开源动态8

妈妈再也不用担心延迟了!斯坦福手搓Llama级内核,推理仅需0.00068秒

斯坦福Hazy实验室推出延迟推理引擎「Megakernel」,将Llama - 1B前向传播融入单一GPU内核,H100上提速1.5倍,B200上每次推理仅0.00068秒,比vLLM快3.5倍。文章分析传统引擎问题并介绍Megakernel设计。

新智元
新闻资讯8

马斯克Grok 4.6重回一梯队!更价格反Fable 5,这Cursor是真没白收购

马斯克携Grok 4.6让SpaceXAI重回大模型牌桌。它跑分GPT - 5.6 Sol和Fable 5 Max,价格更。此次升级聚焦长程agent任务,还发布了Grok Bot智能体,后续Grok 4.7也将登场。

量子位
8

纯CPU“踢开”GPU,中国算九年后再登顶!

6月23日,国家级计算深圳中心“灵晟”算以2.19EFlops性能登顶全球算TOP500榜单,这是世界首台2EFlops的算系统。它基于“灵鲲”平台,采用纯CPU设计,展现我国算全栈自主可控能力。

芯师爷
新闻资讯8

GTC 巅峰对话 Jeff Dean x Bill Dally:预训练范式已死、延迟瓶颈不在计算、谈透 AI 五年未来 | GTC 2026

GTC 2026上,NVIDIA首席科学家Bill Dally和Google Jeff Dean展开重磅对话。讨论了模型能力进步、延迟推理架构、模型自主进化、数据与算力、训练与推理硬件差别等多方面内容,分享对未来AI的看法与见解。

AI科技大本营
算法论文8

RAG新SOTA,还在5亿条数据上跑进秒级,只有它了

本文围绕RAG技术展开,指出传统RAG在多跳推理等方面存在局限。介绍了GraphRAG、HippoRAG 2的优缺点,重点阐述Zleap AI的SAG方案,它用边结构重构数据底座,在多跳问答测试中表现出色,还能在大规模数据下延迟落地。

机器之心
新闻资讯7

AI芯片独角兽一年估值翻番!放话“三年英伟达”,最新融资53亿预期

AI芯片初创企业Groq获7.5亿美元融资,6亿预期,现估值69亿美元,一年翻番。其由谷歌TPU原班人马组建,创始人称构建高速成本AI推理基础设施,还放话三年英伟达。

量子位
新闻资讯7

千亿市值巨头,百亿押注算力产业链

东山精密在今年6月收购光模块企业索尔思光电后股价暴涨、市值破千亿,近日又宣布子公司投资不10亿美元建高端PCB项目。两项投资额百亿,但索尔思光电有研发迟缓、毛利率等问题,东山精密高端PCB技术也不足。

芯师爷
新闻资讯7

Anthropic最新战报:年化收入突破300亿美元,反OpenAI,千家企业客户单笔年消费百万

Anthropic宣布与谷歌和博通扩大合作采购算力,首席财务官称是为跟上增长步伐。其年化营收破300亿美元OpenAI,千家企业客户单笔年消费百万,Claude在多平台上线,二级市场已重新定价。

AI寒武纪
开源动态8

2.6K Star!逼真端侧TTS模型,0.5B参数3秒音频即时克隆!

文章介绍开源项目NeuTTS Air,它是免费、轻量级逼真语音合成模型,仅0.5B参数,媲美商用TTS引擎,能在功耗设备运行,支持3秒音频克隆声音,还给出使用步骤和应用场景。

开源星探