音频重定向」共找到 1139 篇相关文章

产品应用7

Pinterest 利用内容指纹技术,在数百万个域名中实现 URL 去

Pinterest工程师开发“最小要查询参数集”(MIQPS)URL标准化系统,用于优化大规模数据采集管道内容去。它取代传统方法,用数据驱动判断参数要性,还采用早期退出逻辑等提高效率。

InfoQ
产品应用7

vLLM 技巧: 在几秒钟内无需启释放90%的 GPU 显存

EmbeddedLLM介绍vLLM新功能“休眠模式”,可在不启服务时几秒内释放约90% GPU显存,实现模型热插拔与高效轮转,还介绍使用方法、不同休眠级别,提醒生产环境要确保安全。

AI工程化
新闻资讯8

地平线首曝BPU「黎曼」架构,用数学流形构AI计算

2025 年 12 月 8 日深圳举办的地平线技术生态大会上,地平线首曝 BPU「黎曼」架构,用数学流形构 AI 计算。还发布第四代编译器,推出 HSD Together 模式,开源具身智能模型,欲构建物理 AI 世界底层生态。

机器之心
开源动态8

LTX-2开源:首个能同时生成视频和音频的模型

LTX-2开源,它是Lightricks团队开发的首个开源多模态基础模型,能联合生成音频和视频。采用非对称双流扩散变换器架构,用深度多语言文本编码器,速度比许多纯视频开源模型快,让模型理解声画关联。

AI工程化
推荐文章8

改写纳米光学底层逻辑!MIT学者搭建通用可构光子平台

MIT助理教授唐皓凝构建可相对运动的双层纳米光子系统,将机械运动变为可定量科学变量。2024年,她和合作者集成光谱仪和偏振仪功能。她想发展可编程光子架构,还把AI作工具。

DeepTech深科技
新闻资讯8

让龙虾看懂屏幕!谷歌多模态新成果,文本图像视频音频进同一空间

谷歌发布首个原生多模态嵌入模型Gemini Embedding 2,将文本、图像、视频、音频和文档映射进同一嵌入空间,支持多模态混合输入,为AI Agent“看懂”世界提供关键基础,已展开公测。

量子位
新闻资讯7

InfoQ 2026 年趋势报告:AI 写工程师角色,但一切仍然关乎人

InfoQ 2026 年趋势报告探讨了 AI 对软件开发的影响,包括写工程师角色、团队演变等。嘉宾指出 AI 采用应结合风险和业务场景,巩固基础,新设计审查流程,关注质量和人的因素。

InfoQ
新闻资讯7

马斯克成立新公司「巨硬」:用AI把微软产品做一遍

马斯克为硬刚微软成立新公司「巨硬(Macrohard)」,名字针对性强。这是纯AI软件公司,欲用AI模拟微软产品,替代其核心业务。此举动既是商业宣战,也是他与盖茨个人恩怨的延续。

量子位
新闻资讯8

Nature磅预警:ChatGPT切走教育主权,学生大脑或将构?

AI正以“教育革命”之名占领全球校园,如清华新生用AI助理报到,加州州立大学接入ChatGPT Edu,Google向学生免费开放Gemini。但这悄悄写权力格局,让教育主权面临挑战,引发诸多思考。

新智元
新闻资讯7

建安全,Kai种子轮拿了1.25亿美元,有点象龙虾

大模型用于网络攻击,传统安全跟不上节奏。初创公司Kai首笔融资1.25亿美元,它从根本上建安全,用单一智能体AI平台自主完成安全工作,愿景是整合网络安全和IT功能。

AI与安全