GPU内核优化」共找到 1625 篇相关文章

开源动态8

告别天价API账单!开源Chatterbox语音服务器上线,隐私与效率双赢!

第三方语音合成API成本高、有隐私风险,直接部署开源模型配置复杂。开源的Chatterbox-TTS-Server基于Chatterbox TTS模型,有Web界面、声音克隆等功能,支持GPU和Docker,可解决部署难题。

开源星探
产品应用8

nndeploy:一款基于可视化工作流的AI部署工具

nndeploy是简单易用且高性能的AI部署框架,可将推理优化转化为可视化工作流,无需前端技术栈。它还提供端侧完整AI部署方案,有多端推理等功能,介绍了使用方法与技术原理。

GiantPandaLLM
开源动态8

微软开源2025 ICML获奖框架,终结大模型多轮对话严重缺陷

微软开源2025年ICML获奖框架CoLLabLLM,可解决大模型多轮对话缺陷。它由四大模块构成,经多轮对话模拟和奖励优化模型。在三大基准平台测试显示,能在多样任务中高效协作。

AIGC开放社区
产品应用8

GPT-5.1凌晨突袭,奥特曼听劝!全网呼唤的人味回来了

今天,OpenAI GPT-5.1「全家桶」登场,Instant和Thinking同步上线。模型情商智商双核升级,更聪明且聊天有人味。OpenAI还优化自定义ChatGPT语气选项,新功能将逐步开放。

新智元
新闻资讯7

Databricks收购Mooncake,Lakebase想给AI应用换个“心”

Databricks收购Mooncake Labs,旨在推进为AI智能体优化的新型OLTP数据库Lakebase。它基于Postgres,想让数据直接用于工作负载,省去ETL流程,简化AI应用后端数据架构设计。

AI工程化
产品应用7

阿里QwenLong-32B:1W+超长Token推理,知识密集型复杂文档高效推理

文章介绍阿里QwenLong - 32B在长文本推理的能力。长文本推理有训练效率低和优化不稳定问题,QWENLONG - L1通过强化学习等解决,还阐述其组件、训练步骤,并给出实战代码及相关链接。

CourseAI
7

超760万元奖金悬赏,谁能徒手重构 DeepSeek 与 Kimi 的性能底层?

在大模型工程化需求下,AMD 联手 GPU MODE 发起 2026 线上黑客松:AMD E2E Model Speedrun 全球挑战赛,豪掷 110 万美元。大赛分预选赛和决赛,各设丰厚奖励,目前预选赛已进入倒计时。

AI科技大本营
开源动态8

欧洲版DeepSeek发布Mistral 3系列模型,多模态端云生态,无差别商用交付给全球开发者

欧洲最强AI公司Mistral AI发布全系开源模型Mistral 3,从675B到3B参数打通智能链路,采用先进架构,与业界合作优化,以Apache 2.0协议交付全球开发者,推动开源智能发展。

AIGC开放社区
新闻资讯8

MIT给微型机器人做了颗芯片,功耗仅6毫瓦,能实时3D建图

麻省理工学院研究团队开发出名为 Gleanmer 的微型芯片,功耗仅 6 毫瓦,能实时生成三维占据地图。它解决了机器人导航核心问题,通过多项优化提升性能,或让小设备拥有空间理解能力。

DeepTech深科技
产品应用7

Codex自改进Prompt:让AI自己把重复工作变成自动化

开发者Vaibhav更新的Codex自改进Prompt引发AI开发者群体讨论,被OpenAI联合创始人转发。完整版核心逻辑可拆解为8步,加了严格跳过规则。实测有反馈,也有优化建议和现存问题。

AI工程化