「降本方案」共找到 1378 篇相关文章
本地部署Qwen 3.8 27B,要用什么配置
Qwen 3.8 27B是性能好、体积小的开源模型,个人也能本地部署。本地跑开源大模型,重点看容量和带宽两个指标,还介绍了Mac、RTX 5090、RTX PRO 6000三种部署方案及优缺点。
海外chatgpt/gemini的SEO/GEO优化建议
Similarweb 1 月 2 日发布 AI 全球趋势报告,复盘多赛道流量变化。通用 AI 市场竞争激烈,ChatGPT 流量降 22%,Gemini 增 49%;垂直领域头部效应明显。还给出 SEO 和 GEO 优化建议。
FriendliAI获2000万美元,以加速AI模型推理工作负载
专注AI推理的初创平台FriendliAI获2000万美元种子扩展轮融资,资金用于加速平台开发。其专有推理优化技术可降低模型运行成本和能耗,能为用户省90%的GPU成本,合作客户广泛。
Grab 工程实践:将 LRU 升级为 TLRU,Android 图片缓存节省 50MB+
为改进 Android 应用图片缓存管理,Grab 工程师将 LRU 升级为 TLRU。通过引入基于时间的过期机制,fork Glide 项目扩展 DiskLruCache 实现。此方案让 95% 用户缓存省 50MB,可回收数 TB 存储空间。
GPT-5.4发布,拥有原生计算机操作能力,像是给OpenClaw量身打造的模型。
OpenAI凌晨发布GPT-5.4,或是4o模型后提升最大的一次。它价格较合理,有原生计算机操作能力,支持100万token上下文,还有工具搜索功能可降47% token损耗,与OpenClaw适配性佳。
GPT-5.4 发布,OpenClaw的能力要被取代?OpenAI 新模型不仅会自己用电脑,编程能力也拉满了
今天 GPT-5.4 发布,整合推理、编程及原生计算机使用能力。其原生电脑操作能力提升,与 OpenClaw 竞争。还带来工具搜索降成本、减少幻觉,编程能力增强但价格也升级。
Karpathy又封神!掀翻RAG,把你的笔记变成第二大脑
前OpenAI创始成员Andrej Karpathy提出让大模型把笔记「编译」成持续生长的活Wiki,替代RAG。他将笔记当源代码,LLM当编译器,实现知识结构化。此方案降低维护成本,解放人类注意力。
晟德微×北京君正:国产毫米波雷达赋能两轮车智能化
汽车产业智能化推动两轮车迎来‘汽车级’升级,政策与市场需求让毫米波雷达成新引擎。晟德微携手北京君正开发两轮车专用毫米波雷达,采用其Cheetah系列芯片,适配多种场景,将加速方案落地。
把短视频做成流水线的AI剪辑神器
Pixelle-Video是一款AI剪辑神器,输入主题就能自动完成视频创作,零门槛。它采用模块化设计,流程清晰,各环节可灵活定制。支持多种AI模型、TTS方案,有丰富功能亮点。
Token消耗暴降80%,Cloudflare让服务器原生支持Markdown:OpenClaw要笑醒了
Cloudflare发布Markdown for Agents功能,让Web服务器可向AI Agent投喂Markdown数据,抛弃臃肿HTML,Token消耗降80%,还引入内容信号机制,有手动挡工具,功能处Beta阶段,可免费启用。