「性能成本平衡」共找到 3298 篇相关文章
字节开源了一款多模态神器!BAGEL上线,超越Qwen2.5-VL,媲美SD3!
多模态AI发展进入新阶段,字节跳动开源通用多模态大模型BAGEL。它支持多模态输入输出与思维链推理,性能超Qwen2.5 - VL等,安装使用友好,有多种应用场景。
SGLang 中的 CUDA Graph 进阶指南
本文介绍 SGLang 构建 CUDA Graph 支持及改动。如 Runner/Backend 解耦与灵活组合;首创 Breakable CUDA Graph 并开源,能提高捕获灵活性;还实现 Prefill 的 Full CUDA Graph,同时介绍显存管理方法。
自动化评测的九九归一——评测agent
本文提出统一评测Agent架构,实现评测全链路自动化。它能学习标注标准,完成自动标注等工作。还介绍架构、解耦方法、模型优化及训练方案,解决多模态幻觉等问题,提升机审率,节省标注成本。
ClawdBot传疯了!视频教程来了
外网疯传的ClawdBot由开发者Peter Steinberger开发,能通过多平台交互干活。介绍其技术架构、两种设置方式、成本,还有安全设置、测试方法、进阶功能、使用场景及硬件选择等。
OpenAI深夜双王炸!GPT-5.1 Pro紧急发布,降维打击Gemini 3
OpenAI同一天发布GPT-5.1 Pro和GPT-5.1-Codex-Max。前者向Pro订阅用户推出,主打「情商智商」双强;后者在Codex平台上线,专为「长时间、高强度」开发任务设计,采用「压缩」机制,表现出色。
微软开源AI量化神器Qlib
微软开源AI量化平台Qlib,支持多样机器学习范式,解决量化投资挑战。包含数据处理等完整流程,有安装、数据准备等说明,还提供自动化和定制化工作流,以及应对挑战的方案和性能对比。
谷歌与OpenAI对狙,Gemini主打极速性价比,GPT优化对话温度
谷歌与OpenAI对狙,谷歌发布Gemini 3.1 Flash - Lite,主打规模化性价比,专为高频场景设计,成本低、速度快;OpenAI上线GPT - 5.3 Instant,优化对话体验,减少拒答、增强联网搜索等。
一个月重写三次代码库、三个月就换套写法!吴恩达:AI创业拼的是速度,代码不重要
吴恩达在 Y Combinator 演讲分享创业心得,指出执行速度是创业成败关键,创业者最大机会在应用层,介绍提速方法,还回应 AGI 炒作、token 成本等问题。
LLM长文本内卷,谁是真英雄?告别跑分玄学,我们需要一把“公道秤”
OpenNLG Group做了统一长上下文评估框架LOOM - Scope,兼容主流benchmark、model和长上下文加速方法。该框架围绕BENCHMARK、DEPLOYMENT和EVALUATOR三大核心模块,还提出LOOM - Bench应对评估成本制约。
特斯拉Cybercab正式上线:没有方向盘没有刹车,已开始在奥斯汀拉客
当地时间9月3日,特斯拉在奥斯汀启动Cybercab付费服务,该车无方向盘、刹车等。其成本约1.8万美元,远低于对手。不过,它面临监管和技术约束,目前投放规模小,未来发展待验证。