「降本方案」共找到 1381 篇相关文章
GPT5.5代号“蒜你狠”曝光!OpenAI拉响红色警报加班赶制新模型,最快下周就发
面对谷歌攻势,OpenAI奥特曼拉响“红色警报”,集中资源让ChatGPT赶上Gemini 3 Pro。两款新模型曝光,一款下周发布,代号Garlic的明年初或发。ChatGPT流量降,OpenAI财务压力大,Garlic能否助其破局受关注。
8.8K Star!真正的本地实时 Whisper 开源神器,彻底干翻云端 STT!
做实时语音转文字系统,上云端 API 贵且隐私难保障,本地跑 Whisper 延迟高。WhisperLiveKit 是专为本地流式语音识别优化的全栈方案,解决了 Whisper 痛点,有极速处理等功能,适用多类项目。
“坏”数据让模型更“好”?重新审视数据过滤
传统观点认为大型语言模型预训练应过滤“坏数据”,但论文《When Bad Data Leads to Good Models》提出反直觉观点,适度加入有毒数据,通过后训练技术可降低模型毒性,保持一般能力,挑战常规做法。
WhisperLiveKit:本地同步实时语音转文字
实时语音转文字难题待解,现有方案各有缺陷。WhisperLiveKit项目用前沿同步语音技术解决问题,支持多语言同步翻译、实时说话人识别等,还介绍了安装、部署方式,不过效果受语言和模型等因素影响。
OpenAI官宣:重组完成!非营利基金会手握1300亿美金股权,专注两大领域
OpenAI董事会主席Bret Taylor宣布公司完成资本重组,非营利的OpenAI基金会手握约1300亿美元股权,控制营利性业务。基金会初期250亿美元聚焦健康与疾病治疗、AI韧性技术方案。今晚Sam将直播答疑。
视觉生成的另一条路:Infinity 自回归架构的原理与实践
本文整理自字节跳动韩剑在AICon 2025北京站的分享,以Infinity为例介绍自回归视觉生成原理,对比其与扩散模型,展示Infinity升级方案成果,它在高分辨率文本到图像任务能与扩散模型竞争。
稳定训练、数据高效,清华大学提出「流策略」强化学习新方法SAC Flow
本文介绍清华大学和CMU提出的SAC Flow新方案,可端到端优化流策略。它将流策略视作residual RNN,用GRU和Transformer结构稳定训练。在多环境测试中表现优,有稳定、快速、样本效率高的特点。
AI改造出行体验:滴滴的试验能否开启行业范式转变?
滴滴近日面向公众内测上线出行AI助手小滴,颠覆传统打车模式。它能精准理解需求,提供个性化方案,还可进行时空推理和订单规划。滴滴用工程打法攻克难题,还上线MCP服务助开发者定制助手。
告别功能内卷,产业AI需要一记“ACE球” | 甲子光年
文章指出产业AI在金融等行业落地面临挑战,投入产出错配。蚂蚁数科在外滩大会推出‘按效果付费’模式,提出‘ACE’方法论,以行业大模型和实战经验助力落地,成果初显,有望推动AI to B行业变革。
SGLang × RoleBasedGroup(RBG):打通大模型推理PD分离架构规模化落地的“最后一公里”
PD分离架构对大模型推理部署意义重大,SGLang支持该架构且性能佳。但从测试到生产落地难,存在部署、资源、可靠性等问题。SGLang开源RBG项目,结合二者为PD分离架构生产化落地提供方案。