「端到端架构」共找到 3830 篇相关文章
智能体工程的演进:从“是否”到“如何” | 2025年AI智能体状态调查报告【PPT】
进入2026年,企业对AI Agent关注点从构建尝试转向规模化稳定部署。LangChain公司年底发布《AI Agent现状报告》,基于对超1300位相关人员调研,展示智能体工程化图景与趋势,本文拆解报告精华。
英伟达成开源新王?Nemotron 3全新混合专家架构,推理效率升4倍
北京时间今天凌晨,英伟达发布 Nemotron 3 系列开放模型,含 Nano、Super 和 Ultra 三种规模。Nano 已上线 Hugging Face,采用混合 MoE 架构,推理效率提升显著。该系列还具备多种核心技术和实用能力,相关工具和数据集也已开源。
摩尔线程的野心,不藏了
上市15天后,摩尔线程在首届聚焦全功能GPU的开发者大会上,围绕MUSA推出诸多新品,包括新GPU架构、芯片、智算集群和硬件产品,还将开源核心组件,构建生态,其架构创新定义未来AI产业格局。
突破类脑模型性能瓶颈:校正频率偏置实现性能与能效双突破|NeurIPS 2025
香港科技大学(广州)等团队在NeurIPS 2025论文指出,脉冲神经网络(SNN)性能不佳根源是频率偏置,非二进制激活。团队提出Max - Former架构,校正频率偏置,实现性能与能效双突破,卷积架构也适用。
张益唐孪生素数猜想,被GPT-6破新纪录! 北大数学07级苏炜杰:很震撼
2026年9月3日,OpenAI宣布GPT - 6将孪生素数问题最好上界推进到186,打破陶哲轩保持十二年的纪录。此前Julia Stadlmann推到240,Axiom Math压至212。GPT - 6展现数学直觉,证明经Lean 4验证。
Qwen3.8-Flash-Next:SGLang Day-0 支持
2026年8月26日,Qwen团队开源多模态MoE模型Qwen3.8 - Flash - Next,它是Qwen4架构早期预览版。SGLang在发布首日就提供完整支持,模型架构多方面升级,亮点众多,还给出启动命令及配置建议参考。
如何选择合适的 Diskless Kafka
随着企业将 Kafka 迁移至云原生架构,Diskless Kafka 成趋势。本文剖析其兴起原因,重点探讨开源的 AutoMQ 方案,还对比基于 Leader 与无 Leader 两种架构在多维度的差异,助您选合适 Kafka 方案。
上市后的摩尔线程,重心从造芯变成建生态
上市刚满15天的摩尔线程在MDC 2025大会展示全栈技术成果,回应市场关注。其创始人强调生态是GPU行业核心,正构建MUSA生态体系,MUSA架构升级,还揭晓‘花港’架构及两款芯片技术路线。
“龙虾之父”接连点赞,星标 5k+:有道龙虾李良才拆解全场景 Agent 演进逻辑与 Vibe Coding 实战
网易有道推出国内大厂首个 100% 开源 Agent 产品有道龙虾 (LobsterAI),发布不到一月在 GitHub 获 4000+ Star,还获‘龙虾之父’点赞。有道 AI 应用架构师李良才在大会分享其养成史、架构选型及 Vibe Coding 实战。
智能投顾的大模型应用,为什么选择了“大小模型协同”?
大模型时代,金融智能投顾落地是技术与业务安全的双重挑战。北银金科高级算法专家尹辰轩表示采用“大小模型协同”架构,能在性能、准确性与合规间找平衡,还阐述了架构亮点、问题解决办法等。