元认知复用机制」共找到 1253 篇相关文章

推荐文章7

2026年必须搞懂的20个 Agent 工程概念(运行机制篇):大白话一次讲清。

文章聚焦Agent工程运行机制,介绍20个核心概念。如Agent与ChatBot区别在于会‘做’;Harness是模型运行框架;Execution Model决定思考行动范式等,还给出各概念工程实践建议。

AI大模型应用实践
推荐文章7

从 ReasoningBank 到 MetaAgent,RL 未必是 Agent 自进化的必要解?

业内对智能体自进化的探讨开启多路线探索模式。除 RL 优化,记忆系统改进成新方向,如 ReasoningBank 机制。此外,业内还从智能体自我识别、工具和策略辅助等机制探索其他技术路线。

机器之心
新闻资讯7

DeepSeek V3.2爆火,Agentic性能暴涨40%解密

文章解密了DeepSeek V3.2 Agentic性能暴涨40%的原因,即采用交错思维链机制。还对比了其与早期ReAct范式,介绍其效果、原理,以及MiniMax为落地该机制做的工作,最后提到多家模型达成技术共识。

新智元
开源动态8

AgentScope 正式发布 Skills 支持 - 实现渐进式披露

文章指出大语言模型驱动的Agent系统存在核心矛盾,常见上下文加载方案有局限,缺乏灵活机制。介绍了AgentScope发布的Skill机制及渐进式披露策略,还讲了其在Java中的实现,最后分析了适用与不适用场景。

阿里云开发者
算法论文8

大模型是否对问题难度有预判?最新研究揭示 LLM 内部的“难度感知机制

近期论文《Probing the Difficulty Perception Mechanism of Large Language Models》系统性解答大模型能否感知问题难度等问题。研究基于数据集在主流 LLM 上训练轻量线性探针,定位负责难度感知的注意力头,还发现不同模型表现有差异。

深度学习自然语言处理
产品应用7

Skills 真的可以帮我干活了:把工单分析变成一个可复用的 Skill

Anthropic推出Skills时未被看好,Claude Code2.1.3版本解决触发难题。作者将工单分析固化成可复用Skills,指出传统思路获取数据难,提出新方案,还对比了Skills和Workflow,强调前者优势。

阿里云开发者
算法论文8

为什么BF16的FlashAttention会把训练「炸掉」?清华首次给出机制解释,用极简改动稳住训练

社区里长期存在的FlashAttention+BF16训练GPT - 2时loss突然爆炸的问题,清华团队论文给出机制解释。指出是特定条件下数值偏置被放大所致,还给出极小修改稳定训练,且在多模型和硬件上验证有效。

机器之心
开源动态8

Agent 自我改进的六条路

文章梳理了让 AI Agent 不重新训练就能变强的六种机制,包括输出自审、持久记忆、进化搜索、对抗训练、自我修改和编排自优化,介绍了各机制代表项目及成果,指出 AI 学习正从训练溢出到部署阶段。

AGI Hunt
算法论文9

让具身智能体拥有「空间感」!清华、北航联合提出类脑空间认知框架,导航、推理、做早餐样样精通

清华、北航联合提出类脑空间认知框架 BSC-Nav,让具身智能体有「空间感」。它克服现有导航方法记忆难题,有三大记忆组件,实验中性能碾压,能应对复杂任务,真机实测也表现出色。

机器之心
开源动态8

Claude Design开源版本来了!支持超过 71 套最顶级的品牌设计系统,可以直接复刻,构建属于你的顶级网页!

Anthropic的Claude Design闭源,Open Design是其开源替代品。它支持超71套顶级品牌设计系统,可直接复刻构建网页,还支持多种coding agent,有完整提问机制,确保产出符合需求。

GitHubStore