多角色架构」共找到 5551 篇相关文章

新闻资讯8

英伟达官方推理指南来了!6倍无损加速,最优解全是华人写的

9月2日,英伟达技术博客上线《用投机解码做AI模型协同设计》,给出推理加速选型表。列入指南的核心方案由华人团队主导,介绍了从外置草稿模型到n - gram查表法等方案,还提到硬件常数对模型架构的约束。

新智元
新闻资讯7

《麦肯锡2025 AI报告》|附下载

麦肯锡发布2025年AI报告,调查近2000家组织。虽88%企业用AI,但仅39%获实质财务回报。Agent热度高却远未量产,AI在后端降本,红利被高绩效企业获得,还改写企业组织架构

量子位
产品应用8

只用国产GPU训练的大模型性能飙升100%!国内唯一,更懂你

科大讯飞发布全国产算力训练的讯飞星火X1.5,推理效率暴涨100%,综合性能跻身全球顶级。还首发非自回归语音大模型架构,效果提升、成本降低。此外,展示领域应用成果,发布相关产品,开源智能体平台。

新智元
开源动态8

智谱终于发布GLM-4.5技术报告,从预训练到后训练,细节大公开

上个月底智谱开源 GLM-4.5 及轻量版,成绩亮眼引热议。现其技术报告发布,详述预训练到后训练细节,还介绍了开源 RL 框架 slime,展示模型架构、训练阶段等,评估了在任务上的表现。

机器之心
开源动态8

6.1B激活,三榜开源第一!蚂蚁·安诊儿医疗大模型发布

由浙江省卫生健康信息中心等联合研发的开源医疗语言模型AntAngelMed发布。它基于Ling - flash - 2.0,100B总参数仅激活6.1B达约40B密集模型性能,在个权威医疗基准测评中居前列,采用三阶段训练流程,高效MoE架构

AIGC开放社区
新闻资讯7

究竟会花落谁家?DeepSeek最新大模型瞄准了下一代国产AI芯片

近期,DeepSeek发布V3.1新模型,采用全新混合推理架构,在任务表现上有提升。它采用UE8M0 FP8,或为国产推理芯片优化机制。国内家厂商新一代AI芯片支持FP8,未来国产大模型或针对其专门优化。

机器之心
开源动态8

又是王冠:27M小模型超越o3-mini!拒绝马斯克的00后果然不同

27M小模型HRM由拒绝马斯克的00后王冠开发,超越o3 - mini - high和DeepSeek - R1,推理不靠思维链。它采用分层推理等五项核心技术,在测试中表现出色,虽被指通用性不足,但有人看好其仿脑架构

量子位
开源动态8

Qwen3新成员:Embedding系列模型登场!

今天正式发布Qwen3-Embedding系列模型,专为文本表征等任务设计,继承Qwen3语言理解优势。在项基准测试表现卓越,已在平台开源,有卓越泛化性、灵活架构语言支持等特点。

通义千问Qwen
新闻资讯7

Remix 3终结以React为中心的架构

年来,React 一直是全栈 JavaScript 架构基础。但 Remix 3 挑战了这一局面,它遵循渐进式增强和服务器优先原则,将 Web 基本原理置于核心,重新定义构建方式,引发对 React 中心架构的思考。

InfoQ
算法论文8

清华唐杰团队揭示大模型记忆全景

清华唐杰教授团队等发布大模型记忆架构综述,提出三维记忆分类学,将前沿工作统一到理论框架,为LLM设计指明方向,分析了隐式、显式记忆架构,还探讨混合架构挑战与未来方向。

量子位