「成本优化」共找到 2582 篇相关文章
SGLang支持GPT-OSS:从Day 0支持到性能增强
SGLang宣布重大更新,聚焦openai/gpt - oss - 120b模型深度性能优化与新功能。预填充和解码阶段吞吐量显著提升,支持多GPU,有推测解码等功能,还支持智能体应用程序,且不损害模型推理能力。
英伟达全新开源模型:三倍吞吐、单卡可跑,还拿下推理SOTA
英伟达推出专为复杂推理和agnet任务打造的开源模型Llama Nemotron Super v1.5,实现SOTA表现,吞吐量提至前代3倍,可单卡高效运行。它采用NAS优化架构,经多数据集训练,现已开源。
让大模型“跑”在手机里:vivo蓝心端侧部署创新揭秘,性能功耗双优!
在AICon2025上海站,vivo AI研究院工程师章苏迟分享蓝心大模型端侧部署方案。介绍端侧大模型优势及应用场景,阐述内存、性能、功耗等指标优化方法,还提及多业务场景应对策略与安全合规措施。
关于机器人数据,强化学习大佬Sergey Levine刚刚写了篇好文章
训练大模型难度随规模和应用拓展而增加,所需数据海量。机器人领域获取训练数据成本高,研究者尝试找替代方案。强化学习大牛Sergey Levine分析数据组合,认为鱼和熊掌不可兼得,替代数据有局限。
独家干货!Apache Iceberg未来蓝图:Open Lakehouse闭门会核心洞察
作者分享 Open Lakehouse 闭门会洞察,介绍 Apache Iceberg 现状与未来。2025 年 6 月发布 V3 规范,实现跨引擎操作。现正筹划 V4,有元数据优化、CDF 演进等方向,还探讨了 BLOB 类型和 Lance 格式融合等。
刚刚,OpenClaw最猛升级!底层架构大换血,全网等了9天
OpenClaw「2026.3.22-beta.1」预览版上线,对插件系统重构,新SDK替代旧API,ClawHub成首选分发渠道;安全防护升级,封堵多个漏洞;模型配置升至GPT - 5.4,接入Anthropic Vertex等;多平台体验和Agent引擎也有优化。
包云岗:不止步于原位替代ARM,开源是RISC-V破局的关键
在全球半导体产业格局重构背景下,RISC-V从边缘走向核心。第五届RISC-V中国峰会举办,包云岗分享其产业应用观察。虽前景好,但RISC-V面临诸多问题,他认为开源是破局关键,还介绍了降成本案例和香山项目。
GPT-5点赞!八大顶尖机构发布「自进化智能体」全面综述
在2025年,大语言模型已演变为智能体,但现有智能体部署后难以适应变化。格拉斯哥大学等机构学者发布综述,系统梳理自进化AI智能体核心框架与挑战,提出三定律,还介绍了优化技术、应用案例等,并指出未来方向。
MinerU又开源了!这次专治OCR跨页失忆症
文档解析领域,MinerU团队开源了专门给OCR结果做“后处理”的4B小模型MinerU - Popo。它能把碎成一页一页的OCR结果重新拼成文档级结构,解决了当前OCR跨页逻辑断裂问题,且效果和成本优势突出。
Nanbeige4.2-3B:探索通用Agent小模型
在模型越做越大的当下,推理成本成了影响Agent大规模使用的关键因素。南北阁实验室推出Nanbeige4.2 - 3B,在架构、数据构造和训练pipeline层面做了系统工作,评测表现良好,还探索本地个人助手等应用。