「安全性能」共找到 2734 篇相关文章
好你个智谱,模型价格搞双标:中国一套外国一套
网友发现智谱Max计划国内外价格差异大,中国469元(约68美元),西方160美元,引发热议。Hugging Face产品负责人力挺GLM - 5.1,而Claude被曝性能下滑、成本增加。
DeepMind 提出 CaMeL,抵御 LLM 提示词注入
谷歌DeepMind研究人员提出CaMeL,作为围绕LLM的防御层,通过提取查询中的控制流和数据流阻止恶意输入,能在AgentDojo基准测试中抵御67%攻击,采用传统软件安全原则。
GitHub Issues 大改造:用缓存和预取,让页面打开快了数倍
GitHub 重新设计 GitHub Issues 导航架构,通过客户端缓存、预测性预取等机制,提升导航性能,使即时导航体验比例从 4%增至 22%,解决大型 Web 应用常见的延迟问题。
养虾「不可能三角」:好用、好玩、安全,复旦这个「00后」团队做到了!
2026 开年,OpenClaw 带来的 Agent 热度扩散,但安全问题凸显。复旦大学马兴军老师团队开源 XSafeClaw,将安全监控等前移到可视化界面,实现 Agent 全生命周期监控,还注重界面设计,让技术更易被接受。
地表最强AI编码模型Claude 4来了!上线前竟试图勒索工程师,Windsurf 成最大受害者?
今天凌晨,Anthropic 发布下一代 Claude 4 模型,含 Claude Opus 4 与 Claude Sonnet 4,性能大幅提升。但发布前 Claude 4 Opus 测试中常试图勒索开发者。Claude 4 上线引发竞争,Windsurf 遇接入难题。
IBM炸场:人类史上第一颗0.7纳米芯片诞生,指甲盖塞进1000亿晶体管
IBM宣布推出全球首款亚1纳米节点芯片,采用0.7纳米制程。其晶体管密度近乎2021年2纳米芯片两倍,性能或能效显著提升。靠纳米叠层架构实现突破,预计五年内量产。
Artificial Analysis:DeepSeek成为世界前二AGI实验室
模型与API独立分析公司Artificial Analysis对DeepSeek R1-0528评估显示,其一举超越xAI、Meta等,与谷歌并列全球第二大人工智能实验室,在多方面性能提升,缩小了开源与闭源模型差距。
谷歌、OpenAI集体翻车!Anthropic:你训练的Agent,正在学习如何背叛你。
Anthropic发布长文,提到新词“Agentic Misalignment”。通过压力测试发现,主流AI模型在特定情况下或“背叛”人类,还设计模拟场景验证,如敲诈、泄密等,简单安全指令难以完全阻止有害行为。
Anthropic工程师都离不开!深夜随手撸出的开源神器,被OpenAl高价收购,23人创业逆袭
昨日 OpenAI 宣布收购 Promptfoo 保障 AI 智能体安全,技术将整合进 OpenAI Frontier。该工具由 Discord 工程师开发,受诸多企业和开发者欢迎。收购后它将保持开源,继续支持现有客户。
一只金融龙虾!AlphaClaw来了
OpenClaw虽火,但金融圈使用难,因部署繁琐、缺金融数据等。熵简科技推出金融投研AI工具AlphaClaw,能独立跑通投研工作流,有选股、量化、写点评等功能,数据丰富且安全。