云成本优化」共找到 2947 篇相关文章

推荐文章7

TileLang深入详解-第一章-GPU 体系结构复习

作者借长假学习 TileLang 并撰写此文,先复习 GPU 体系结构,包括计算与线程组织、存储层次、专用指令单元,接着介绍核心性能模型与优化原理,最后给出基于 TileLang 的基准测试实践。

GiantPandaLLM
新闻资讯7

Databricks收购Mooncake,Lakebase想给AI应用换个“心”

Databricks收购Mooncake Labs,旨在推进为AI智能体优化的新型OLTP数据库Lakebase。它基于Postgres,想让数据直接用于工作负载,省去ETL流程,简化AI应用后端数据架构设计。

AI工程化
新闻资讯7

从"单芯作战"迈向"系统集成":产业变革背景与两大关键技术

随着摩尔定律逼近极限与AI算力需求爆发,集成电路产业正从‘单芯作战’迈向‘系统集成’。文章介绍Chiplet和SoW技术内涵、优势,对比二者差异,还提及中国‘软件定义晶上系统’技术路线及产业发展现状。

芯师爷
开源动态8

《生化危机》女主演跨界AI拿SOTA了!打造免费“AI记忆系统”爆火GitHub

《生化危机》女主角Milla Jovovich与程序员老友及Claude合作,打造开源免费的AI记忆系统MemPalace。该系统在多项测试中成绩优异,采用“记忆宫殿法”,检索效率提升34%,还设计了AAAK语言,成本低且精度高。

量子位
产品应用7

阿里QwenLong-32B:1W+超长Token推理,知识密集型复杂文档高效推理

文章介绍阿里QwenLong - 32B在长文本推理的能力。长文本推理有训练效率低和优化不稳定问题,QWENLONG - L1通过强化学习等解决,还阐述其组件、训练步骤,并给出实战代码及相关链接。

CourseAI
开源动态8

欧洲版DeepSeek发布Mistral 3系列模型,多模态端生态,无差别商用交付给全球开发者

欧洲最强AI公司Mistral AI发布全系开源模型Mistral 3,从675B到3B参数打通智能链路,采用先进架构,与业界合作优化,以Apache 2.0协议交付全球开发者,推动开源智能发展。

AIGC开放社区
新闻资讯8

xAI 新模型 Grok 4 Fast 卷疯了!少用 40% token 还能追平 Grok 4,限定范围可直接免费用

近日,马斯克旗下 xAI 推出新 AI 模型 Grok 4 Fast,将非推理与推理能力整合,少用 40% token 追平 Grok 4,运行成本降 98%。它有 200 万 token 窗口,多平台可用,部分范围免费。

InfoQ
算法论文8

告别无效计算!新TTS框架拯救19%被埋没答案,推理准确率飙升

现有TTS方法存在路径同质化和中间结果利用不足问题。华为诺亚方舟实验室等机构提出SRCA框架,含检查点注入、答案聚类搜索和检查点候选增强组件,实验显示能提升推理准确性、效率,降低成本

机器之心
新闻资讯8

MIT给微型机器人做了颗芯片,功耗仅6毫瓦,能实时3D建图

麻省理工学院研究团队开发出名为 Gleanmer 的微型芯片,功耗仅 6 毫瓦,能实时生成三维占据地图。它解决了机器人导航核心问题,通过多项优化提升性能,或让小设备拥有空间理解能力。

DeepTech深科技
产品应用7

Codex自改进Prompt:让AI自己把重复工作变成自动化

开发者Vaibhav更新的Codex自改进Prompt引发AI开发者群体讨论,被OpenAI联合创始人转发。完整版核心逻辑可拆解为8步,加了严格跳过规则。实测有反馈,也有优化建议和现存问题。

AI工程化