「GSM8K-V」共找到 1557 篇相关文章
一个Dispatch Dtype引起的fp8 quant kernel性能问题
文章记录SGLang社区在sgl-kernel中解决的fp8 quant kernel性能问题,因错误使用`c10::Float8_e4m3fn`数据类型,未用硬件加速指令,通过软件调用致性能下降,现已修复,vLLM也应用此修复。
全网爆火的Kimi-k2驱动Claude Code亲测可食用版本来了「附详细配置」
Claude Code好用但贵,Kimi-k2表现不错且API价格便宜。月之暗面团队为Kimi K2提供与Anthropic兼容的API端点,文章给出在Claude Code使用Kimi K2的亲测配置方法。
神秘爆款模型被小米认领!雷军直言超过马斯克 xAI Grok,罗福莉透露MiMo-V2-Pro将开源
小米发布 MiMo-V2 家族三款新模型,确认 Hunter Alpha 是 MiMo-V2-Pro 早期版本。雷军称其超马斯克 Grok,罗福莉透露模型稳定后将开源。MiMo-V2-Pro 适用于 Agent 场景,Omni 关注全模态交互,TTS 面向语音生成。
8.8K Star!真正的本地实时 Whisper 开源神器,彻底干翻云端 STT!
做实时语音转文字系统,上云端 API 贵且隐私难保障,本地跑 Whisper 延迟高。WhisperLiveKit 是专为本地流式语音识别优化的全栈方案,解决了 Whisper 痛点,有极速处理等功能,适用多类项目。
8.8k星星!开源的211个专家级Agent,一键接入,一个人就是一个团队
今天推荐agency-agents-zh库,它是agency-agents深度汉化版,有211个精选Agent,适配国内生态。需注意,skill并非越多越好,按需选择,避免浪费资源和输出无效结果。
TPU vs GPU 全面技术对比:谁拥有 AI 算力最优解?
SemiAnalysis对Google TPU v7/v8深度拆解,将TPU与Nvidia GPU多方面对比拆到可计算层面。不过其结论有局限性,本文重新分析,指出TCO因场景而异,互联体系分歧在流量假设,Google TPU v8成本优势被削弱。
五年,终于等来Transformers v5
Transformers v5发布首个RC版本v5.0.0rc0,跨越从v4到v5长达五年的技术周期。其日下载量从2万次激增至超300万次,总安装量突破12亿次。v5将PyTorch确立为唯一核心后端,聚焦四大维度进化。
6.3K star!再见了Docker Desktop,容器与 K8s 管理的终极利器,效率飙升!
和容器打交道,过去首选可能是Docker Desktop,但它有商业许可限制、资源占用高等问题。今天分享免费开源的替代品Podman Desktop,它集成多项功能,还自带Kubernetes集成,很受开发者欢迎。
替代n8n,用TypeScript写工作流
文章指出n8n、Zapier拖放式工作流调试难、自定义受限,介绍Bubble Lab工具,其用TypeScript实现,代码可自由修改,执行信息透明,还支持导入n8n工作流文件再开发,有一定优势。
2.8K Star!基于Nano Banana Pro的Vibe PPT神器!
GitHub上的banana - slides项目很火,近一周涨2K+ Star。它是基于Nano Banana Pro的Vibe PPT生成工具,不强调套模板,能将想法、氛围和内容结构转成幻灯片,还具备多种强大功能。