「Blog文章」共找到 1488 篇相关文章
Harness 工程就是控制论
文章指出OpenAI的Harness工程模式与瓦特离心式调速器、Kubernetes类似,都遵循控制论。代码库此前反馈回路在低层面,大语言模型改变现状,但需校准传感器和执行器,忽视工程实践代价会变得无法承受。
让问题不过夜:交易领域“问诊”Agent实践
文章针对研发支持中的痛点,构建智能Agent系统,将问题抽象为业务答疑与问题诊断两类能力。介绍了系统架构、构建演进、知识体系、质量评估等内容,还展示实战成效,指出当前边界与下一步方向。
用Spring AI Alibaba把MultiAgent实现从5天压到5小时
Spring AI和Spring AI Alibaba新版本支持Multi - agent编排。文章展示基于Spring AI Alibaba实现Multi - agent,从原理到实战,给出示例代码,解决手写框架问题,对比两种编排方式优劣,强调选对框架可提升开发效率。
今天,分享Clawdbot记忆系统最佳工程实践
文章分享了 Clawdbot 记忆系统的最佳工程实践。它能自主处理现实任务,其持久记忆系统独特,将一切保留在本地。文中介绍了上下文构建、记忆存储、搜索等方面,还提及多代理记忆、压缩、刷新等内容。
Skills火爆之后,我收集并整理了最近全网火爆的Skills,拿走不谢~~~
文章介绍 Agent Skills,称其是 AI 助理的「使用指南」,技能分浏览、加载、使用三阶段加载,有快且轻、跨平台、易分享等优势。还推荐多个优秀 skills 及相关工具网站,提醒从业务出发看待它。
Ray异构融合底座重构数据管道:架构演进与万卡落地实践
文章指出大模型发展下,传统大数据引擎在多模态数据处理局限性凸显。腾讯基于Ray构建新一代数据管道,介绍了云原生调度与计算范式融合架构,详述容错、资源利用等方面优化实践,展示了重构收益。
142 TFLOPS 的差距:为什么在 Blackwell 上 FP4 MoE 算子工程至关重要
文章对三种主流MoE后端在Blackwell B200 GPU上做基准测试,发现SGLang与vLLM有142 TFLOPS差距,小batch时SGLang快1.84×。差异源于kernel融合、面向Blackwell的CUTLASS schedule及自适应grid sizing等优化。
Andrej Karpathy:做个好人,未来的 LLM 正在看着你
Andrej Karpathy 12 月 10 号写 blog,用现在视角为十年前 Hacker News 帖子自动打分,开源代码。他近期多篇文章探讨 LLM 相关,如可验证性、智能空间对比等,还启动 Eureka Labs。他认为未来 LLM 会审视当下行为。
产品研发AI提效实践:PRD智能体在需求领域的提效探索
随着AI发展,企业探索用其优化产品开发流程。文章介绍PRD和系分智能体落地进展,目标提升产研效率、规范文档管理,阐述技术方案、能力展示,也指出RAG链路等方面挑战及后续研究方向。
从 LLM 到 World Model:为什么我们需要能理解并操作世界的空间智能?
文章指出 LLM 仅靠语言不足以支撑真正智能,构建空间智能与世界模型成关键方向。2024 年李飞飞等创立 World Labs,11 月推出 3D 世界生成模型 Marble,本文探讨空间智能重要性及世界模型如何成转变基础设施。