自回归架构」共找到 2864 篇相关文章

开源动态8

全球首个AI智能体「进化」开源框架来了!一次部署,终生可用

英国格拉斯哥大学团队发布全球首个AI智能体进化开源框架EvoAgentX,打破传统多智能体系统构建与优化限制。它有动化构建、进化机制和系统性评估亮点,实验验证其性能提升显著。

新智元
推荐文章8

配置驱动的动态Agent架构网络:实现高效编排、动态更新与智能治理

本文提出配置驱动的独立运行时 Agent 架构,解决低代码/平台化 Agent 方案企业级落地难题。介绍其核心架构、注册中心、配置定义等,还提及 Agent Studio、执行引擎等,阐述运行部署、协作、治理,提供通用可落地范式。

阿里云开发者
产品应用8

模型换个Harness就「变笨」?EverMind把进化从研究推向产品,让AI「越用越聪明」

同一模型换 Harness 表现或大幅波动,暴露进化走向产品的两个关键问题。EverMind 用 HarnessBank、Raven 与 EverMe 解决,将进化从研究推向产品,让 AI「越用越聪明」。

机器之心
开源动态7

重磅!中国团队发布SRDA新计算架构,从根源解决AI算力成本问题,DeepSeek“神预言”成真?

国内玉盘AI团队发布《SRDA AI大模型专用计算架构》白皮书,提出全新SRDA计算架构,从硬件源头解决AI算力成本瓶颈。它以数据流为核心,在内存、网络等方面创新,为开发者带来高效、低成本等价值。

InfoQ
产品应用7

一家智能眼镜公司,为什么非要研AI大模型系统?|甲子光年

智能眼镜要么不够智能,要么不像眼镜,李未可科技CEO茹忆认为AI要成第一响应者。该公司推三款AI眼镜,搭载研系统。其研AI大模型系统,是为交付难复制AI体验闭环,解决通用API不足等问题。

甲子光年
产品应用8

10亿国民App丝滑升级AI应用!高德携手通义重构的底层架构曝光

高德用AI重构底层技术栈,建立主 - 从Agent架构,将千问大模型与空间智能结合。新架构分Agent层、模型层和工具层,还依托生态数据和通信协议。这让高德从工具变智能体,为行业转型提供范式。

量子位
产品应用8

Hybrid Model Support:阿里云 Tair 联合 SGLang对 Mamba-Transformer 等混合架构模型的支持方案

文章介绍阿里云 Tair KVCache 团队与SGLang社区在推理框架上支持混合架构模型的工程化实践。分析混合架构崛起原因、面临挑战,阐述内存管理、关键技术优化方案,验证性能,并指出未来演进方向。

阿里云开发者
新闻资讯7

OpenAI研芯片270天光速成功!谷歌TPU大将主导,老黄一夜大客户变对手

OpenAI发布研推理加速芯片Jalapeño,与博通和Celestica合作打造,专为大模型优化,9个月就流片。操刀者是前谷歌TPU核心成员Richard Ho,计划2026年底部署。此前谷歌、微软等已研芯片,英伟达客户变对手。

量子位
推荐文章7

大小模型协同架构在金融智能投顾中的应用与挑战

本文整理北银金科高级算法专家尹辰轩分享,介绍大小模型协同架构下的大模型投顾方案,能解决幻觉问题、优化回答深度。还提到 12 月 19 - 20 日 AICon 北京站聚焦多热门方向。

InfoQ
算法论文8

全新GPU高速互联设计,为大模型训练降本增效!北大/阶跃/曦智提出新一代高带宽域架构

随着大模型参数规模扩大,分布式训练成关键路径,高带宽域设计对提升训练效率至关重要。现有HBD架构在可扩展性、成本和容错能力等方面有局限,北大、阶跃、曦智团队提出InfiniteHBD架构解决问题。

量子位