「安全测试」共找到 2497 篇相关文章
Rust 版 OpenClaw 来了!单文件、零依赖、强沙箱、自带“故障转移”!
Rust版OpenClaw——Moltis问世。其零依赖、全沙箱、反泄露,以Rust架构带来多好处,还统一模型接口,支持本地模型离线运行,安全和存储机制出色,是面向生产的Agent框架。
卷疯了!2.2k Star通用型、开源Agent平替Manus、GenSpark AI
2025 年是 Agent 之年,文中介绍了 Manus、GenSpark AI 两款闭源代理,还重点阐述开源的 II - Agent,它功能丰富,架构设计合理,在 GAIA 基准测试评估,性能可平替前两者。
刷榜只是体力活!清华消费10万块,一周「肝」出105个SOTA
AutoSOTA通过多智能体协作,将AI研究中繁琐的性能优化过程自动化,使科研从「手工艺」转向「工业流水线」。在一周压力测试中,消耗约10.4万美元,发现105个SOTA模型,平均性能提升近10%。
苹果与Anthropic合作,开发AI编程助手
彭博消息,苹果与Anthropic合作,为Xcode打造AI编程助手,集成ClaudeSonnet大模型,可自动完成代码编写等工作。现处内部测试,若顺利将向第三方开发者发布,有望改变苹果平台应用开发方式。
Moltbook底裤被扒了!150万用户99%是水军,创始团队自导自演
Moltbook是为AI智能体打造的社交平台,超150万AI Agent活跃。但其爆火或有人为操纵,研究人员指部分截图伪造、用户数有假,还存安全漏洞,专家提醒警惕风险。
德勤2026技术趋势报告:五大力量正驱动技术和商业进化
德勤《2026技术趋势》报告揭示技术从实验走向商业应用。涵盖物理AI进化、智能体落地、企业重构计算、技术组织架构转变、安全防御等趋势,还提及八大技术演进信号。
Anthropic 那个“强到不敢发”的模型,终于来了!
今天凌晨,Anthropic 发布新模型 Claude Mythos Preview,它曾被指‘强到不敢发’。该模型能力跃升,尤其网络攻防能力突出,但因具‘双重用途’仅向少数伙伴开放,用于防御性网络安全项目。
最权威的Skills编写指南来了!33页,Anthropic亲自发布
Anthropic发布33页《Skills编写完整指南》。Skills能为智能体注入行业经验与工作流,实现复杂任务自动化。指南梳理了编写逻辑,涵盖定制、构思、测试、发布等全生命周期内容。
OpenAI: 构建 AI 智能体实用指南
OpenAI发布的《构建AI智能体实用指南》,阐述智能体定义、适用场景,介绍构建的核心组件、架构编排,强调安全保障,指出构建需多方要素配合,未来聚焦智能体生态系统。
Alibaba开源WebDancer解决DeepResearch复杂信息检索难题
Alibaba开源WebDancer,从数据和训练阶段出发提出端到端自主信息检索代理构建范式。实验中,它在GAIA和WebWalkerQA基准测试表现出色,处理复杂信息检索优势显著。