「认知安全」共找到 1194 篇相关文章
Claude Opus 4.7发布:更强能力,自我纠错,越来越不需要人类干预了
Anthropic发布Claude Opus 4.7版本,搭配Routines功能可自动化工作,人类干预减少。该版本能力大幅增强,还引入护栏机制保障安全,推出新运算级别和任务预算功能。
钢铁版OpenClaw,Transformer作者用Rust打造,告别数据裸奔
OpenClaw开源后虽发展迅速,但存在严重安全问题,如数据明文处理、隐私保护缺失、恶意组件等。Transformer论文作者Illia Polosukhin用Rust打造IronClaw,重构底层架构,升级记忆引擎,还指向去中心化经济。
OpenAI透露协议细节,已做好随时终止的准备
OpenAI公开与美国国防部协议细节,设三条红线,有更全面安全防护。合同含违约条款,其称预计政府不违约,但做好终止准备,体现科技公司平衡商业与伦理。
年前看到最有深度的AI下半场Agents记忆机制综述
本文是一篇83页的基础智能体记忆机制综述,由27家机构联合发表。提出AI研究范式转变,记忆是填补理想与现实差距的关键。构建三维统一分类框架,介绍记忆操作、学习策略、评估体系、应用场景及未来方向。
AI Agent 总翻车?这篇综述戳破了 3 个关键误区
很多团队做AI Agent停留在‘LLM+工具’表面拼接,运行易出问题。该综述指出AI Agent是‘系统’,介绍其架构,还给出常见误区的应对方法、落地检查清单,展望应用前景。
ClawdBot传疯了!视频教程来了
外网疯传的ClawdBot由开发者Peter Steinberger开发,能通过多平台交互干活。介绍其技术架构、两种设置方式、成本,还有安全设置、测试方法、进阶功能、使用场景及硬件选择等。
2026 AI Memory最新综述:从理论到实战,一文读懂AI记忆的进化全景
2026年北邮百家MemoryOS团队联合华为发表《Survey on AI Memory》,涵盖AI记忆理论基础、4W分类体系、单/多智能体架构、评估方法与前沿趋势,梳理详尽全景图,还剖析未来挑战与方向。
Claude Code迎来大更新:Agent能力增强
Claude Code 2.1.0正式发布,围绕Agent能力、开发者体验和安全性全面升级。有大量功能新增,如技能与Agent的热重载、上下文分叉等;修复诸多问题,还进行了性能、可靠性等方面的优化。
Andrej Karpathy爆料:自己家被Claude Code入侵了
Andrej Karpathy做实验让Claude Code入侵自家Lutron智能家居系统,成功接管全屋设备。此前网友用其控制烤箱等,引发连锁反应。但这也暴露物联网设备安全问题,还带来新威胁。
听LLaMA Factory、vLLM、RAGFlow作者亲述顶级开源项目的增长法则|GOBI 2025
在开发中,开源项目易,维护让其活起来难。12月21日GOBI 2025大会上,LLaMA Factory、vLLM、RAGFlow等项目作者将分享顶级开源项目增长法则,大会还有众多精彩环节等。