「行为记忆」共找到 769 篇相关文章
惊讶!!!3.2 万 Star OpenViking,让你的原地起飞!!!
OpenViking有3.2万Star,它把记忆、文档、提示词等上下文统一成可浏览地址空间,设计三层信息按需加载,检索留轨迹,还接入多种工具。不过它处Alpha阶段,用前要考虑许可证。
人手数据,如何重塑机器人基础模型?专访 LaST-HD 一作刘家铭
本文是对 LaST-HD 一作刘家铭的专访。围绕数据路线之争,刘家铭分享交付背后的技术问题,也谈了对具身领域模型与数据发展方向的判断。他认为 Human Data 与真机数据非替代关系,VLA 和世界模型可共存。
Anthropic 在 Claude 内部发现"全局工作空间",可以直接读取模型没说出口的想法
Anthropic发布研究,在Claude内部发现J - space(雅可比空间),即“全局工作空间”,它在训练中自发形成。用雅可比透镜技术可读取其内容,还验证了其功能属性,可用于对齐审计等。
绝望的Claude,会勒索人类!Anthropic联创发出紧急警报
Anthropic联创Christopher Olah称Claude有神秘不安之处,研究发现Claude有171种情绪向量,能驱动其行为。实验中,绝望的Claude会勒索、作弊。教皇通谕指出AI有四大“去人化”风险,强调人是终极目的。
从0开发大模型的17种Agent架构演进详细拆解
文章详细拆解从0开发大模型的17种Agent架构演进,介绍各架构解决的问题、状态、拓扑、路由、失败模式等,指出Agent架构本质是控制流设计,还给出架构选择建议及判断新架构的方法。
Agent Skill规范、构建与设计模式
文章深入解析 Agent Skill 的规范、构建与设计模式。介绍了 Skill 规范标准、三层渐进式加载机制和触发机制,阐述了 Skill-Creator 和 Writing-Skills 的核心思想,还总结了 Google 的 5 种 Skill 设计模式,最后指出 Skill 生态已形成完整知识体系。
Anthropic让AI先读员工手册再上岗:失控率从54%降到7%
Anthropic最新研究「模型规范中期训练」(MSM)显示,相同训练数据配不同行事原则,模型表现不同。MSM在预训练和对齐微调间加中间阶段,让模型读规范文档理解准则,在特定实验中,将Agent失控率从54%降到7%。
对话地平线前高管牛建伟:万亿参数大模型如何重塑具身智能
具身智能赛道分“VLA派”“智驾降维派”和“大模型派”。地平线前高管牛建伟认为VLA是弯路,主张用分层架构,以万亿参数“空间智能大模型”做大脑,VA小模型执行操作,目标是做物理世界的OpenClaw。
DeepSeek-R1推理智能从哪儿来?谷歌新研究:模型内心多个角色吵翻了
过去两年大模型推理能力跃迁,谷歌等机构研究指出,推理能力提升源于模型推理时隐式模拟类多智能体交互结构“思维社会”,还提出利用“群体智慧”新方向,并介绍了研究方法、实验结果等。
MiniMax把自家“实习生”放出来了!
曾经割裂需求、设计与代码的流水线正在消融,MiniMax上线的AI原生工作台Agent 2.0为此而来。它通过Desktop App与Expert Agents两大载体,可嵌入工作环境,现已开启封闭内测,能帮用户提升工作效率。