「三阶段架构」共找到 3130 篇相关文章
开源的 V0/Lovable 替代方案Libra AI
Libra AI是面向生产环境的AI原生开发平台,可通过自然语言交互管理Web应用全生命周期。它功能丰富,如AI智能编码、集成开发体验等。其开源有技术自主、架构灵活等好处,还介绍了技术架构、上手方式与部署方案。
AI 原生应用全栈可观测实践:以 DeepSeek 对话机器人为例
本文以 DeepSeek 对话机器人为例,介绍 AI 原生应用架构可观测需求、挑战与方案实践。分析 AI 领域痛点,提出阿里云 AI 全栈可观测架构,剖析大模型应用可观测技术,分享实战案例,还给出未来规划。
“老程序员”为啥不迷信 AI 带来的效率提升?聊聊 AI 编码的局限与现实
开发经验丰富的人对AI编码提升效率更保守,因现有开发模式下,AI编程效率提升有限。特定场景AI给力,但项目复杂时提升迅速下降,还分析了原因,最后提到微服务架构或在AI编程时代重新火起来。
黄仁勋2025都在投啥?出手50次,32家公司覆盖产业链闭环
2025年前三季度,英伟达参与50笔AI风投超去年全年。投资覆盖基础设施、模型厂商、应用等领域。其AI俱乐部有32家公司,分三档。英伟达鲜少领投,黄仁勋不信AI有泡沫,投资能锁定硬件订单。
北大团队提出 SHINE:将任意文本转化为大模型 LoRA,仅需一次前向传播!
北大团队提出全新超网络架构 SHINE,仅需一次前向传播就能将任意文本转化为大模型 LoRA 参数,支持多轮对话。该方法实用潜力大、架构创新高效,训练流程成熟,推理快速,为大模型持续学习提供新思路。
字节Seed新作:模型合并如何改变大模型预训练范式
字节跳动Seed团队在arXiv发表论文,提出预训练模型平均(PMA)技术。该技术将模型合并引入预训练阶段,可提升性能、预测衰减阶段表现,还能解决训练问题。不过,高学习率影响和强化学习应用待研究。
跳过“逐字生成”!蚂蚁集团赵俊博:扩散模型让我们能直接修改Token | MEET2026
在量子位MEET2026智能未来大会上,蚂蚁集团赵俊博称扩散架构能直接修改控制token,理论上速度更快、成本更低。他团队押注扩散架构,近期开源千亿规模LLaDA 2.0。该领域虽处早期,但发展快,吸引众多巨头和初创公司布局。
牛芯基于UB协议,以IP筑牢生态根基
本文围绕牛芯半导体在UB协议生态中的IP布局展开。UB协议填补国内空白、打破国外垄断,牛芯的PHY IP等取得进展。还介绍其设计理念、架构优势等,如对等架构、单边语义等,以及在内存池、拥塞控制等方面的应用,助力开放算力生态。
重塑记忆架构:LLM正在安装「操作系统」
现代大型语言模型(LLM)存在「记忆缺陷」,难以维持长期记忆。近期关于大模型记忆的研究增多,如 MemOS 等。文中介绍了长上下文处理能力与记忆的关系、记忆类型,以及实现 LLM 记忆的多种方法和相关研究成果。
Claude 最歧视的,是印度阿三
AI研究员Aran Komatsuzaki实验发现,Claude的tokenizer对非英语用户不友好,印地语用户消耗token是英语的3.24倍,带来高成本、高延迟等问题。不同模型对不同语言token处理有差异,市场份额影响token效率。