开源基础设施」共找到 3294 篇相关文章

开源动态7

NovaSR:一个52KB的音频超分模型,把16kHz模糊音频变成48kHz清晰版

最近,只有52KB的音频超分辨率模型NovaSR开源,能把16kHz模糊音频变成48kHz清晰版,处理速度极快,可实时处理音频流。它能提升TTS模型质量等,虽有不足,但平衡了速度与质量。

AI工程化
开源动态8

2.6K Star!超逼真端侧TTS模型,0.5B参数3秒音频即时克隆!

文章介绍开源项目NeuTTS Air,它是免费、轻量级超逼真语音合成模型,仅0.5B参数,媲美商用TTS引擎,能在低功耗设备运行,支持3秒音频克隆声音,还给出使用步骤和应用场景。

开源星探
开源动态8

单机H200最快DeepSeek V3和R1推理系统优化秘籍

作者从开源技术分享角度,盘点SGLang对单机规模推理的大量工程优化技巧,涉及FP8 Block GEMM演进、FusedMoE模块优化、Attention Backend优化等,助于提升DeepSeek V3/R1在单机H200上的推理性能。

GiantPandaLLM
产品应用7

Agent从一问一答到自主执行面临哪些挑战?

随着AI发展,Agent正从答疑助手走向自动执行任务的数字人,定时调度是其走向自主运行的关键。开源Agent定时任务存在无高可用、运维成本高、权限管理弱等痛点,阿里云MSE AI任务调度有高可用、统一管理等优势,现免费公测。

阿里云开发者
新闻资讯8

刚刚,AMD、OpenAI联合发布超强AI芯片,推理提升35倍

今天凌晨,AMD举办2025全球AI发展大会,与OpenAI联合发布Instinct MI400、Instinct MI350系列超强AI芯片。MI350推理性能提升35倍,MI400内存配置大幅提升。AMD还开源ROCm7平台,7大AI平台与其合作。

AIGC开放社区
开源动态8

一键式训练端到端Agent,Qwen3+MCP工具集高效集成!

RLFactory是开源的端到端RL后训练框架,将环境与训练解耦,用Qwen3基座调用MCP工具集,可低代码训练端到端Agent模型。它极致易用、训练高效,还支持一键式训练,未来会更易用高效。

深度学习自然语言处理
开源动态8

从分钟级等待到20倍超速:LightX2V重写AI视频生成速度上限

今年,开源项目LightX2V在ComfyUI社区走红,单月下载超170万次。它是面向低成本、强实时视频生成的推理技术栈,能在消费级显卡上高效生成视频,还支持多种模型和硬件,覆盖不同用户需求。

机器之心
新闻资讯7

讲习班日程公布|第四届全国大模型智能生成大会(LMG 2025)

第四届全国大模型智能生成大会(LMG 2025)11月1 - 3日在成都召开,预计超千人参会。11月3日的讲习班邀请四位青年专家,围绕AI基础设施、扩散语言模型等前沿议题,分享技术进展与实战经验。

深度学习自然语言处理
新闻资讯8

一图看透全球大模型!新智元十周年钜献,2025 ASI前沿趋势报告37页首发

新智元十周年峰会发布《2025新智元ASI前沿趋势报告》与《2025新智元ASI产业图谱》,预测2027达ASI临界,智能体全面爆发。报告展示全球大模型格局,中国开源模型表现亮眼,还揭晓了创新大奖。

新智元
新闻资讯7

刚刚,DeepSeek最新发文!V3/R1训练细节全公开,信息量巨大

网信办新规生效,DeepSeek回应,标注AI生成内容,公开V3/R1训练细节。介绍训练分预训练和优化训练,深挖数据使用,还谈及推理、开源情况,也提到对抗AI幻觉与滥用风险的措施。

新智元