气动优化设计」共找到 2375 篇相关文章

推荐文章8

NVIDIA技术沙龙《强化学习流水线优化:性能分析与 Rollout加速》演讲笔记

该演讲笔记围绕强化学习流水线优化,强调用Nsight Systems做性能分析,介绍在Ray Actor添加参数及解读文件方法。给出训练/生成参数优化技巧,如Actor训练和Rollout优化,还以Qwen 2.5 7B等模型为例总结参数调优经验。

GiantPandaLLM
产品应用7

新版 Android 插件登场,应用能瘦身 50%,Google 把代码优化和资源压缩合二为一

Google在新版Android Gradle Plugin引入资源压缩优化方案,合并代码优化与资源压缩。新方案让应用体积最高缩减50%,开发者有四种优化方式可选,AGP 8.12.0已提供该流程,AGP 9将默认开启。

InfoQ
推荐文章8

小红书 FinOps 实践:云成本优化与资源效率提升之道

在 InfoQ 举办的 QCon 全球软件开发大会上,小红书梁啟成分享云成本优化实践。介绍了小红书用云情况,分析成本优化面临的问题,阐述成本洞察和优化的探索,如内外账分离、CPU 和 GPU 资源提效等,还展望了 AI for FinOps 实践。

InfoQ
推荐文章8

AI Infra进入自进化时代!清华团队用「AI优化AI」造就国产万亿Token工厂

AI自主优化RSI成新焦点,被视为通往AGI的关键路径。硅谷为此沸腾,中国也不落后。清昴智能由清华团队创立,率先打造自进化算力底座,还基于国产算力打造万亿Token工厂,目标是让优化成为持续运行的基础能力。

量子位
产品应用8

腾讯混元AI Infra如何优化Hy3 Preview:一次大模型推理性能提升的技术拆解

文章聚焦腾讯混元AI Infra对Hy3 preview模型的推理性能优化。从算子优化与融合、并行策略等五大维度,剖析技术思路、算法及收益,如Attention算子单batch长文本最高加速2.95x,还提及后续显存优化等工作。

腾讯技术工程
推荐文章7

基于一个MXFP8量化Kernel谈一谈如何在B200上实现高性能的Memory Bound Kernel

作者向SGLang社区提交基于CUTLASS的MXFP8 Blockscaled Grouped GEMM实现,其中包含量化Kernel。文章关注此Kernel,介绍在B200上实现高性能Memory Bound Kernel的优化技术,如整体设计、向量化与合并访问、Occupancy优化、TMA利用等。

GiantPandaLLM
开源动态8

卡内基梅隆大学开源LegoGPT,用AI设计乐高模型

卡内基梅隆大学开源LegoGPT,可依文本提示生成物理乐高模型。它把乐高设计转为自回归文本生成任务,基于LLaMA - 3.2 - 1B - Instruct微调,应用场景广泛,如教育、玩具设计等。

AIGC开放社区
推荐文章8

Agent Skill规范、构建与设计模式

文章深入解析 Agent Skill 的规范、构建与设计模式。介绍了 Skill 规范标准、三层渐进式加载机制和触发机制,阐述了 Skill-Creator 和 Writing-Skills 的核心思想,还总结了 Google 的 5 种 Skill 设计模式,最后指出 Skill 生态已形成完整知识体系。

阿里云开发者
产品应用8

设计行业天塌了!Anthropic再推王炸产品Claude Design:设计稿、原型、PPT一句话搞定

Anthropic推出平台级产品Claude Design,用Claude Opus 4.7模型助力设计。它能让各类用户完成视觉内容创作,有多种使用场景和便捷工作流程,还给出内部设计师使用建议。

AI寒武纪
开源动态7

骨灰级克隆网站设计的开源项目

现在克隆网站设计常停留在截图和吸色,难以完全还原。designlang 项目用无头浏览器打开 URL,从实时 DOM 读取设计系统,输出多个文件,还能做到布局模式等其他提取器做不到的事。

GitHubStore