「记忆查看器」共找到 791 篇相关文章
1w颗星!多平台 LL M 聊天机器人及开发框架AstrBot!
AstrBot是聊天机器人及开发框架,松耦合、异步,支持多消息平台部署。它功能丰富,支持多种大语言模型,有Agent能力、插件扩展等,还介绍了多种部署方式、平台及提供商支持情况。
大模型「越用越快」!SpeedupLLM首次验证,大降56%推理预算
Emory大学研究者提出SpeedupLLM框架,利用动态计算资源分配和记忆机制,使LLM处理相似任务时推理成本降56%、准确率提升,论文系统性验证了LLM“越用越快”,为AI模型发展提供新思路。
如何判断 AI 将优先自动化哪些任务?
思考AI优先自动化哪些任务,可从‘描述 - 执行鸿沟’视角出发。‘描述 - 执行鸿沟’大的任务是自动化沃土,反之自动化价值有限且创建训练数据难,它与‘判别器 - 生成器鸿沟’相似又不同。
Cloudflare 推出 Agent Tracing:支持截断限制,不同框架的 Payload 默认记录策略存在差异
Cloudflare推出Agent Tracing,可提供统一Dashboard查看已部署Agent会话。该功能在现有Workers Tracing基础上增加Agent级别的Span,有收费时间表。不同框架Payload默认记录策略有差异,Trace有截断限制。
基于阿里云 AgentLoop 的 DeepSeek Harness 评测实践
本文分享基于阿里云 AgentLoop 平台的 DeepSeek Harness 评测实践。介绍了 DeepSeek Harness 工程架构,阐述 AgentLoop 平台接入方式及价值,还详述评估器设计思路、展示评测结果,最后总结方法论并展望后续工作。
长程执行成具身智能必考题,墨奇的答案是Agentic-Native|甲子光年
具身智能中长程执行成关键问题,墨奇智能发布具身模型架构MoRA,提出Agentic - Native技术路线,让Agentic能力原生存在于策略模型中,还介绍了模型内部设计、所需数据等内容。
第 3 章 Agent 核心功能技术详解
本章以Claude Code及其生态为主参照,介绍现代Agent平台提供类似‘操作系统’机制,包括命令、记忆等。面向熟悉Python与LLM的开发者,按是什么、解决什么问题等展开,还分析了Agent工程核心挑战。
五源投资人笔记:Agent 是新生命,它今天很饿|5Y View
五源投资人石允丰认为,Agent是新生命,以OpenClaw为例,它持续运行,有心跳、记忆等特征且消耗大量token。这引发AI市场“双链分裂”,代谢链潜力大,还带来可靠性、编排等投资机会。
AMS | 西工大向锦鹏、宋述芳等:一种用于伴随方程求解的物理约束图神经网络
伴随方法用于高维优化问题,但求解伴随方程代价大。本文提出物理约束图神经网络(ADJ - PCGN),构建流场解与伴随向量映射模型,有精度和泛化性,能加速优化,方便嫁接求解器。
探索文本压缩极限!C3纯文本压缩pipeline:20倍压缩解码准确率98%
DeepSeek团队的DeepSeek - OCR技术引发关注,研究者重新审视视觉压缩路径后提出C3技术。C3采用纯文本压缩管道,实验表明其压缩精度远超DeepSeek - OCR,还具独特遗忘模式,代码模型均已开源。