「自主探索建图」共找到 1203 篇相关文章
强化学习+大模型记忆:Mem-α,让智能体第一次学会“如何记忆”
在大语言模型发展中,‘记忆’是智能体具备长期智能的关键。现有外部记忆系统有局限,Mem-α将强化学习引入大模型记忆管理体系,解决记忆难题,在性能、泛化等多方面表现出色。
中美六大顶尖模型第一赛季实盘量化交易结果出炉:Qwen最后反超夺冠,GPT-5垫底「复盘」
Nof1机构发起Alpha Arena项目,让六个顶尖LLM在Hyperliquid交易所实盘量化交易。第一赛季已结束,Qwen夺冠、GPT - 5垫底。复盘比赛过程,发现模型行为差异大且操作有脆弱性,第二赛季筹备近尾声。
理解规范驱动开发:Kiro、spec-kit和Tessl
作者尝试理解规范驱动开发(SDD),查看了 Kiro、spec - kit 和 Tessl 三个自称 SDD 的工具。介绍了 SDD 定义、规范含义,分析评估工具的挑战,还指出工具存在不适合多数编程问题、审查体验差等问题。
AI杀入美股,DeepSeek又是第一!港大90后开源,AI股神人人都能造
在港大「AI - Trader」项目中,DeepSeek以9.68%收益率击败GPT、Claude等顶级模型,成为能在美股自主盈利的AI交易系统。项目开源,还暴露出AI不同「性格」,显示市场是AI终极试金石。
DeepSeek开源新模型,提出上下文光学压缩:LLM的新记忆方式
DeepSeek开源OCR模型,探索用多少视觉信息让LLM理解文本。实验表明1000字文档约需100个vision tokens,压缩比10倍、准确率97%。还提出模拟人类遗忘等想法,有多种应用场景,且完全开源。
tRPC-Agent-Go:构建智能AI应用的Go语言Agent框架
tRPC是腾讯内部覆盖最广的RPC开发框架,tRPC-Go使用最广。2023年起LLM发展迅速,Agent开发框架成重要基础设施。tRPC-Agent-Go集成LLM等,支持创建多种Agent,为开发者提供构建智能应用的完整技术栈。
从上下文工程到 AI Memory,本质上都是在「拟合」人类的认知方式
文章结合胡塞尔现象学,探讨从上下文工程到AI Memory,指出它们本质在‘拟合’人类认知。介绍二者概念及构建方法,对比人类与AI记忆异同,还通过与胡塞尔对话,思考AI意识等哲学问题。
AI三问:Agent、LLM、RAG,一文厘清!
文章介绍大语言模型(LLM)、检索增强生成(RAG)和AI智能体(Agent)三种架构。阐述其概念、工作原理、应用场景、优缺点,还做了横向对比,给出选用建议,最后提及混合架构与未来趋势。
Agent 都这么厉害了,「AI 员工」为什么今天还没有真正出现?
AI员工呼声高却未落地,瓶颈可从其源起探寻。早期自动化工具非真正数字员工,大模型带来新可能,但存在时效性、场景定义、意图澄清、知识更新、博弈能力等问题,未来建议局部替代,先以实习生角色上岗。
击败Meta登榜首:推理增强的文档排序模型ReasonRank来了
本文第一作者刘文涵聚焦AI搜索研究。提出推理增强的文档排序模型ReasonRank,在多个榜单击败多校和机构登榜首,其7B版本超越32B模型,论文获Huggingface paper日榜第一。还介绍研究动机、方法及实验结果等。