「多模型轮转」共找到 9624 篇相关文章
全国首部!AI 大模型私有化部署标准起草单位 / 个人征集启动!
国内首部AI大模型私有化部署标准《人工智能大模型私有化部署技术实施与评价指南》立项,正征集起草单位和起草人。该标准全流程覆盖、多方面融合、三方协作,能解决企业部署痛点,构建安全可信生态。
央企牵头!这个AI开源社区要让大模型跑遍「中国芯」
6月30日百度文心大模型4.5系列开源并登陆魔乐社区,该社区发起‘模型推理适配协作计划’,想让大模型跑遍中国芯。其升级工具中心和协作空间,联动产业力量,解决模型在国产芯适配难题,推动生态发展。
英伟达官方推理指南来了!6倍无损加速,最优解全是华人写的
9月2日,英伟达技术博客上线《用投机解码做AI模型协同设计》,给出推理加速选型表。列入指南的核心方案多由华人团队主导,介绍了从外置草稿模型到n - gram查表法等方案,还提到硬件常数对模型架构的约束。
The Batch: 894 | 面向生物医学的多模态模型
过去几年联合推理模型进展快,但生物医学领域能力碎片化、脆弱或难解释。2026 年,学术界应推进多模态模型建设,关注深度整合、可解释性、数据效率和适应性及模型在工作流中的整合。
单卡搞定万帧视频理解!智源研究院开源轻量级超长视频理解模型Video-XL-2
智源研究院联合上海交通大学等机构发布新一代超长视频理解模型Video-XL-2。它单卡能处理万帧视频,编码2048帧仅需12秒,在效果、长度和速度上全面优化,已开放模型权重。
AI根本守不住秘密!不依靠大模型的输出过滤才是铜墙铁壁
开发者常把秘密放系统提示词,以为安全。Swept AI和密西根大学团队测试发现,攻击者不断尝试,AI会泄露秘密。多种依赖大模型的防御方案失败,只有输出过滤能零泄露。
狂拿大模型明星订单,一家清华系HPC-AI Infra公司浮出水面
本文介绍清华系计算创业公司是石科技,其93年创始人闫博文不囤算力仍拿下大模型明星公司订单。团队技术实力强,3次获戈登·贝尔奖。公司构建全栈能力,为多领域提供服务,未来想以算力赋能各行业。
精打细算虾养成指南: 省 Token 和把 AI 用好,从来就是一件事
文章指出用AI时Token成本高、模型变笨,原因是上下文管理不善。介绍了省Token和用好AI的方法,如按需取上下文、明确约束、多智能体协作、按阶段切换模型等,核心是在合适时间将合适上下文装入合适模型。
谷歌开源非结构化数据抽取工具
谷歌开源 Python 库 LangExtract,用 LLM 从非结构化文本文档提取结构化信息。它定位精确、输出可靠,针对长文档优化,有交互式可视化,支持多模型,适应多领域,还给出快速开始示例。
不止于快!美团新推理模型正在重新定义「实用主义AI」
美团发布并开源推理模型 LongCat-Flash-Thinking,它在权威测评表现突出。该模型有多项创新,能更快、更能干、更可靠。其将技术实力转化为业务服务能力,实战测试表现佳,体现美团实用主义 AI 路径。