软件栈优化」共找到 2065 篇相关文章

推荐文章8

让AI智能体拥有像人类的持久记忆:基于LangGraph的长短期记忆管理实践指南

文章围绕让AI智能体拥有持久记忆展开,深入探讨Agent Memory概念,聚焦LangGraph框架下长短期记忆实现,详解存储、管理、检索技巧,还通过引入MCP协议的实战案例展示构建多Agent系统。

腾讯技术工程
推荐文章8

LlamaIndex 深度实战:用《长安的荔枝》学会构建智能问答系统

文章兼顾 RAG 科普与 LlamaIndex 实战。介绍 RAG 原理,用《长安的荔枝》讲解关键步骤和参数。实战部分展示用 LlamaIndex 搭建问答系统,代码量少。优化篇通过实验给出参数调优建议,架构篇剖析内部机制,最后提及 Agent 化拓展功能。

阿里云开发者
新闻资讯7

墙体的AI革命!智能超表面如何让建筑「听懂」6G信号?

在5G基站功耗高、室内信号衰减成瓶颈的当下,文章探讨6G如何借智能超表面和建筑无线友好性优化室内流量。还分析建筑设计对信号的影响,以及人类移动行为给超表面嵌入建筑信道带来的挑战。

新智元
推荐文章7

AI 引领的企业级智能分析架构演进与行业实践

在 QCon 全球软件开发大会(北京站)上,数势科技 AI 负责人李飞分享了企业级智能分析架构演进与实践。探讨了智能分析落地问题,介绍 Agent 结合数据分析优势、技术路线及落地要点,还对 Agent 发展给出思考与展望。

InfoQ
新闻资讯8

刚刚,英伟达祭出下一代GPU!狂飙百万token巨兽,投1亿爆赚50亿

昨天,英伟达发布专为海量上下文AI打造的CUDA GPU——Rubin CPX,将大模型推理带入「百万Token时代」。它性能强大,能带来高回报,可重写推理经济,还将得到英伟达全AI生态支持,预计2026年底可用。

新智元
新闻资讯7

DeepSeek正开发高级AI Agent模型,硬刚OpenAI

彭博消息,DeepSeek正开发高级AI Agent模型与OpenAI竞争。此模型能在极少指令下执行多步任务并自我优化,计划Q4推出。此前该司模型表现佳,技术已在多领域落地,但构建AI Agent仍有挑战。

AIGC开放社区
新闻资讯8

刚刚,英伟达新模型上线!4B推理狂飙53倍,全新注意力架构超越Mamba 2

Jet - Nemotron是英伟达推出的小模型系列(2B/4B),由全华人团队打造。其提出PostNAS与JetBlock,实现架构优化。相比Qwen3等模型,它在多维度准确率更高,H100 GPU上推理吞吐量最高提升53倍。

新智元
产品应用8

10亿国民App丝滑升级AI应用!高德携手通义重构的底层架构曝光

高德用AI重构底层技术,建立主 - 从Agent架构,将千问大模型与空间智能结合。新架构分Agent层、模型层和工具层,还依托生态数据和通信协议。这让高德从工具变智能体,为行业转型提供范式。

量子位
产品应用8

一条SQL管理向量全生命周期,让AI应用开发更简单

在大模型驱动的AI浪潮中,向量在AI应用开发中至关重要,但开发者面临技术分裂等隐形成本。PolarDB IMCI提出解决方案,在数据库内核集成向量索引与Embedding能力,用一条SQL管理向量全生命周期,降低开发和维护门槛。

阿里云开发者
新闻资讯7

摩尔线程之后,又一家国产 GPU 独角兽完成上市辅导

6月23日,国产GPU龙头沐曦IPO辅导完成,将提交申报材料。其为异构计算提供全GPU方案,产品有曦思N、曦云C、曦彩G系列。曾与书生・浦语3.0合作,2024年交付多个算力集群。此外,国产GPU厂商纷纷IPO。

InfoQ