「架构重构」共找到 2726 篇相关文章
Jina Reranker v3: 全新“列式”重排器,0.6B参数刷新文档检索SOTA
Jina AI推出第三代重排器Jina Reranker v3,在多语言检索基准上刷新SOTA。它参数仅6亿,有“last but not late”交互机制,能一次性处理查询和文档。还提供动态量化格式,方便不同硬件部署。
全网首测!首款国产GPU「AI算力本」现场上手
新智元报道首款国产GPU「AI算力本」MTT AIBOOK,它搭载国产全功能显卡,预装开发环境,打破系统壁垒。其背后的MUSA架构全栈自研,软件升级、有翻译工具,硬件架构革新,还有开源计划,产品应用广泛。
NVIDIA技术沙龙 《大规模EP优化:PD分离MoE并行方式》课程笔记
本文是NVIDIA技术沙龙课程笔记,介绍大规模EP优化的PD分离MoE并行方式。涵盖PD分离、大规模专家并行等五项关键技术创新,还对比多模型架构,展示推理服务架构性能特点与优化策略,以及各技术工作流程和效果。
刚刚,英伟达新模型上线!4B推理狂飙53倍,全新注意力架构超越Mamba 2
Jet - Nemotron是英伟达推出的小模型系列(2B/4B),由全华人团队打造。其提出PostNAS与JetBlock,实现架构优化。相比Qwen3等模型,它在多维度准确率更高,H100 GPU上推理吞吐量最高提升53倍。
将思维链(CoT)引入具身世界,哪种路径能真正打通机器人「知行合一」?
文章围绕将思维链(CoT)引入具身智能领域展开。介绍CoT从语言层面到成为机器人行为核心认知机制的转变,分析分层架构与端到端模型两种技术路径,还阐述自变量机器人统一架构的优势和能力。
核心AI场景首超英伟达,一场国产算力的“破局叙事”|甲子光年
1月26日,天数智芯公布四代架构路线图,其2025年的天数天枢架构,在DeepSeek V3场景实测性能领先英伟达Hopper约20%。该企业以技术创新、解决行业痛点等构建新范式,产品全场景布局且已规模化落地。
当EDA(消息驱动架构)遇到AI Agent:消息驱动在智能体时代的重生
文章探讨消息队列与AI Agent的融合。回顾消息队列发展历程,阐述多智能体协作系统成为AI落地核心架构的原因,分析消息队列与AI Agent的融合点,介绍Apache Pulsar对AI Agent的赋能,还展望了AI与中间件的双向进化。
11.77亿资本押注卡车新势力「一哥」,L2升维路线率先在商用车跑通!
2026年初,自动驾驶卡车新势力DeepWay深向完成11.77亿元Pre - IPO轮融资,国资、外资、产业资本齐参与。该公司靠卖新能源重卡营收可观,采用L2升维L4的战略,自研重卡与智驾技术成熟,其发展路径获资本看好。
李飞飞发布全新世界模型
李飞飞团队的World Labs发布两款新模型Marble 1.1和Marble 1.1 - Plus,能将平面照片转化为3D世界、提升画面清晰度。二者各有侧重,前者重画质优化,后者重空间生成,官方建议新用户从1.1开始用。
大模型能“原地”改参数了!字节Seed&北大新论文:测试时推理无需加层重训练
字节Seed和北大研究团队提出In - Place TTT方案,让大模型能“原地改参数”。它复用Transformer的MLP模块,解决现有TTT架构不兼容、计算效率低和优化目标不匹配问题,实验证明可提升模型长文本任务表现。