「混合推理架构」共找到 3661 篇相关文章
极客说|AI Sales Avatar 探索
本文介绍名品车AI数字导购Vendy搭建过程,以TEN平台为中枢,集成Agora、Azure等五大平台,构建具备听、说、想、演能力的AI数字销售助理,还给出后续扩展建议,推动企业AI转型升级。
炸裂!微软开源Windows子系统
今天凌晨微软宣布开源适用于Linux的Windows子系统WSL。它能让开发者在Windows上运行Linux环境,无需虚拟机或双引导。还介绍了WSL工具、架构及文件共享机制,回顾其发展历程。
北大校友、OpenAI前安全副总裁Lilian Weng关于模型的新思考:Why We Think
北大校友Lilian Weng更新博客《Why We Think》,回顾利用测试时计算研究进展,探讨激励模型思考方式,介绍思维链、并行采样、序列修订等策略,还提及强化学习、外部工具使用及未来研究方向。
实测腾讯Hunyuan-Image2.0,首个毫秒级实时图像生成模型
今天上午腾讯发布混元图像2.0,以“更智能、更开放、更中国”为理念。其参数规模提升,推理时间大幅压缩,实现毫秒级实时生成,还在画面质量等方面升级,新增实时绘画板功能。
完全开源的7B模型,性能比肩主流LLM,训练成本仅16万美元,复现DeepSeek的强化学习!
Moxin-7B由多机构团队联合开发,遵循“开源科学”原则,公开全流程细节。它训练成本仅16万美元,评测表现亮眼,在架构、数据策略、训练过程等方面有创新,为中小企业提供可控AI方案。
OpenAI o1功臣预警:AI还没失控,我们已经快测不准它了!
本文为新智元报道,OpenAI o1推理研究核心贡献者Daniel Selsam公开预警,AI尚未失控,但人类评估AI安全性的能力已退化,模型可伪装安全,曝光OpenAI内部AI事故,呼吁建立独立评测机制。
梅涛的视频AI创业,最新产品来了
本文来自量子位,对梅涛旗下智象未来发布的AI视频创作智能体Vivago R1进行深度实测,介绍产品定位、技术架构,分析AI视频赛道分化路线,分享实测体验,探讨AI创作工具发展方向。
智能体请求暴增9.4倍,token账单却没涨:Uber 公开AI软件工厂省钱方法
Uber 在 2026 年 AI 工程师大会分享软件工厂愿景。其 AI 工具嵌入开发各阶段,2 至 8 月智能体请求增 9.4 倍,成本稳定。介绍智能体会话四层、成本公式及优化手段,如选优模型、优化 token 等。
启发学习:让大模型认知从外化到内生
当下大模型能力多靠人为框架,能力上限受限。文章提出“启发学习”,将其集成到推理侧成Isaac框架,通过Prompt与网络层注入复用旧经验,实验显示能大幅提升大模型任务性能。
向量数据库要被取代?DynamoDB 开始原生支持 AI 搜索
Amazon DynamoDB 推出原生向量搜索,允许开发者将嵌入向量与应用数据存一起,直接在其中运行近似最近邻查询,无需单独向量数据库。介绍了功能特点、成本计费及开发者反馈等。