「核心认知能力」共找到 4773 篇相关文章
AI记忆革命爆发!Clawdbot如何像大脑般记住一切
2026年初开源个人AI助手Clawdbot引爆社区。它可本地运行、集成聊天平台、自主处理任务,有长时记忆和任务执行能力。AI研究工程师Manthan Gupta复盘其记忆机制原理,涉及上下文、记忆存储、搜索等内容。
蚂蚁具身研究首次亮相!就解决了机器人「看」透明玻璃这些难题,还开源了
蚂蚁灵波科技开源高精度空间感知模型 LingBot-Depth,针对性解决机器人识别真实世界的「玻璃问题」。其构建双线并行数据集,提出掩码深度建模思路,在深度补全等任务中表现出色,且已具备落地能力。
从 ReAct 到 Ralph Loop:AI Agent 的持续迭代范式
文章围绕AI Agent持续迭代范式展开,指出AI编程助手现存过早退出等问题,介绍了Ralph Loop范式,阐述其核心要素、原理、优势,对比与传统智能体循环差异,还给出使用最佳实践、适用场景与建议。
任意条件,「可控」文生图扩散模型综述 | TPAMI'25
北京邮电大学团队在顶级期刊IEEE TPAMI发布综述,探讨文生图扩散模型可控生成技术,将核心问题概括为如何注入新型条件信号并稳定控制,从任务和方法层面梳理技术,还提及应用场景与未来方向。
168小时AI狂写300万行代码造出浏览器!Cursor公开数百个智能体自主协作方案
Cursor创始人公布实验结果,让数百个AI智能体跑一周,从零造出可用Web浏览器,产出超300万行代码,项目源码已公开。此次实验靠GPT - 5.2 - Codex,还设计了智能体协作架构,引发业界讨论。
不止于量化:最新综述用「时-空-构」三维视角解构KV Cache系统级优化
随着LLM向1M上下文演进,KV cache成推理服务效率核心瓶颈。墨尔本大学和华中科技大学研究者发布深度综述,用「时间 - 空间 - 结构」视角梳理KV cache优化方法,还归纳关键观察、提出开放挑战,并整理了资源库。
老黄在CES 2026 上预言:将要告别应用软件的预编译时代,未来的应用是 GPU 上实时生成每一个像素
黄仁勋在CES 2026预言,应用将告别预编译时代,在GPU上实时生成像素。他回顾2025年AI关键进展,介绍Agentic AI特点与能力,还谈了其搭建及应用前景,指出未来软件或基于Agent交互。
Meta 突然百亿收购Manus,小扎再收百人团队,肖弘任副总裁!季逸超感叹:两个辍学生的道路交汇了
今早,Manus 宣布加入 Meta,收购金额达数十亿美元。此前字节跳动曾试图收购被拒。加入后,肖弘任 Meta 副总裁,核心团队并入 Meta AI。业内看法不一,有人赞创业成功,也有人质疑通用 Agent 是大厂游戏。
深度拆解:如何在 LangChain DeepAgents 中复现 Claude 的 Skills 机制 ?
本文探讨在LangChain的DeepAgents框架复现Claude的Skills机制。先回顾Skills,它是Anthropic提出的Agent能力注入方式,有渐进式加载特点。接着介绍让通用框架支持Skills的环节,最后测试验证其效果和收益。
从CLI原理出发,如何做好AI Coding
文章从CLI原理出发探讨AI Coding,介绍CLI产品美学、技术原理,比较Single Agent与Multi Agent,还给出用好CLI写代码的建议,如正确认识AI、学习Prompt工程等,最后提及利用通义万相AIGC实现图像生成。