大模型技术」共找到 10342 篇相关文章

新闻资讯7

全国首部AI模型私有化部署标准,公开征集起草单位和个人!

近期AI领域政策频出,企业对AI应用需求攀升,倾向私有化部署,但面临诸多问题。国内首部AI模型私有化部署标准《人工智能模型私有化部署技术实施与评价指南》立项,正征集起草单位和个人。

PaperAgent
开源动态7

Qwen3小升级即SOTA,开源模型王座快变中国内部赛了

开源模型进入中国时间,Kimi K2风头正盛时,Qwen3迎来升级,235B总参数量仅为Kimi K2四分之一,基准测试性能却超它。Qwen官方不再用混合思维模式,新模型仅支持非思考模式,此次是小更新,招在后头。

量子位
推荐文章8

告别“试验田”:当模型真正嵌入 ERP、供应链与核心决策流 | AICon

文章围绕模型嵌入企业核心系统展开,邀用友罗小江等担纲。介绍鞍钢赵伟升级 RAG 技术、用友罗小江构建决策架构、京东耿东阳用模型优化供应链的案例,为企业数智化转型提供参考。

InfoQ
推荐文章8

NVIDIA技术沙龙 《规模EP优化:PD分离MoE并行方式》课程笔记

本文是NVIDIA技术沙龙课程笔记,介绍规模EP优化的PD分离MoE并行方式。涵盖PD分离、规模专家并行等五项关键技术创新,还对比多模型架构,展示推理服务架构性能特点与优化策略,以及各技术工作流程和效果。

GiantPandaLLM
新闻资讯7

315曝光的“AI投毒”原理:GEO这样操控模型推荐

央视3·15晚会揭开AI“投毒”灰色产业链,利用GEO操控模型推荐。介绍了训练数据污染、检索上下文劫持、提示注入诱导攻击三种“投毒”技术,还阐述了内容生产、渠道投放、效果强化的产业链运转流程。

量子位
新闻资讯8

刚刚,智源全新「悟界」系列模型炸场!AI第一次真正「看见」宏观-微观双宇宙

6月6日第七届智源会,智源研究院推出全新「悟界」系列模型,含原生多模态世界模型Emu3、脑科学多模态通用基础模型见微Brainμ等,反映其对模型发展的研判,推动AI向物理世界迈进。

机器之心
推荐文章7

模型狙击黑产:挚文集团社交生态攻防实战全揭秘

挚文集团生态技术负责人李波在AICon会分享模型在社交生态落地实践。介绍集团生态问题,提出构建治理框架,还阐述多模态模型研发方案、细粒度用户画像建设及审核侧应用,最后总结现状并展望未来。

InfoQ
新闻资讯7

性能翻番背后:讯飞与昇腾,如何用国产算力炼就模型?|甲子光年

在全球AI竞争激烈背景下,科讯飞与华为昇腾深度合作意义重。双方合作历经四阶段,实现性能提升与技术突破,还通过软硬件协同构建AI自主发展竞争力,加速模型行业落地。

甲子光年
新闻资讯8

对话淘宝姜宇宁:如果你只推低价商品,是不需要用语言模型

淘宝姜宇宁团队上线RecGPT百亿参数推荐模型,对“猜你喜欢”功能技术升级。模型赋予传统推荐系统新能力,如让其“白盒化”、理解长上下文等。姜宇宁认为AI要创造商业价值,落到业务场景形成正向循环。

AI科技评论
产品应用7

昇腾910B模型实测:开源框架能不能打?真相全放这了

文章对昇腾 910B 模型进行实测,对比 vLLM Ascend 与 MindIE 在实际推理场景中的性能差异。通过 GPUStack 平台测试多种模型,结果显示两者在不同部署场景各有优势,vLLM 适合单卡小模型,MindIE 适合模型多卡部署。

探索AGI