产品应用7
BBuf:Codex助力SGLang代码优化
GiantPandaLLM
AI 摘要
作者BBuf:用Codex在SGLang优化代码,大幅缩短开发时间。要注重代码风格、理解代码、找专家Review。分享多方面优化成果,Claude Code使用遇阻,Codex限制少更实用。
阅读原文 · GiantPandaLLM
Codex在推理框架上能蹬出什么优化
作者复盘用Codex在SGLang中的实践,原本需3 - 4个月的工作量现缩短为1个半月。介绍保证代码质量方法,分享印象深刻的debug经历,列举在SGLang用Codex一个月的优化成果,还提及Claude Code使用遇阻。

关注公众号
扫码关注
第一时间收到每日精选
相关文章
推荐文章7
白杨SEO:教你让AI推荐企业官网
白杨SEO从网站代码优化、站内内容、站外推广三方面,介绍让AI推荐企业官网及做好官网GEO优化的方法。如代码优化要主动提交网站、部署SSL证书等,还给出企业官网老板执行清单。
白杨SEO优化教程
开源动态8
SGLang:CUDA Graph 进阶技术突破
本文介绍 SGLang 构建 CUDA Graph 支持及改动。如 Runner/Backend 解耦与灵活组合;首创 Breakable CUDA Graph 并开源,能提高捕获灵活性;还实现 Prefill 的 Full CUDA Graph,同时介绍显存管理方法。
GiantPandaLLM
新闻资讯7
OpenAI:解锁 Codex 百万上下文及超快模式
最近基模发布多,OpenAI 俩更新被低估忽略。一是 GPT - 5.6 Sol 的 Ultrafast 模式,输出最高达每秒 750 Token,先向少量 API 客户开放;二是 Codex 为其开放百万上下文能力,不过大窗口有代价。
MacTalk
产品应用7
Codex开放1M上下文,GPT - 5.6 Sol封印解除
现在3行配置就能让GPT - 5.6 Sol封印解除,在Codex里用上1M上下文。不过有网友警告轻易别用,因超出默认窗口,模型消耗token速度会翻倍,且模型上下文利用能力会下降。此外,Codex确定会上Astra。
量子位