安全信号」共找到 1045 篇相关文章

算法论文8

借助CoT监管AI?OpenAI、谷歌、Anthropic等罕见联合发文:AI系统安全的新机遇!

OpenAI等支持新研究论文,其指出高级AI不透明性有潜在风险,而‘推理模型’用自然语言推理带来可解释窗口,CoT监控可检测不当行为、发现早期信号等,但也存在使监控性下降的因素。

PaperAgent
推荐文章8

从传统编程转向大模型编程

文章指出大模型编程时代,开发者要从‘代码产出者’变为‘文档定义者’,介绍其优势、人+AI结对编程模式,还提及模型工具技巧、开发流程、常见陷阱及应对策略,强调文档驱动和安全合规。

阿里云开发者
开源动态8

谷歌MCP Toolbox for Databases拆解:助你快速构建数据访问智能体的神器

企业Agent运行常需访问数据库,但会遇到工程问题。本文详解谷歌开源项目MCP Toolbox for Databases,介绍其概念、好处、使用方式,还展示安装、配置、启动过程及不同模式下使用方法,兼具安全管控与可观测性。

AI大模型应用实践
新闻资讯7

从 VLM 到 VLA,智驾距离跨过「L2.9999」还有多远?

2025 年上半年,国内智驾安全受关注,浮夸宣传行不通。文章探讨厂商智驾宣传卡「L2.9999」玄机、端到端成主流原因等,分析了 L2 与 L3 区别及事故责任界定,还提及车企应对策略。

机器之心
开源动态7

为老父亲做的桌面 Agent,不小心在 GitHub 霸榜一周

OpenHuman是TinyHumans AI构建的开源桌面AI Agent,登上GitHub榜单并霸榜一周。它想成桌面级个人AI操作系统入口,但使用体验与愿景有差距,工程架构有亮点,也存在安全风险,其产品哲学有价值但执行粗糙。

AI科技评论
推荐文章8

Anthropic 的 Harness 哲学:把 Agent 当牲口,而非宠物

本文分享Anthropic最新两篇博客,介绍其将运维圈“宠物 vs 牲口”哲学用于AI Agent架构设计。旧架构如“宠物”易出问题,新架构脑手分离,把Harness做成可随时重启的“牲口”,降低延迟、提升安全,还提出信任框架。

AGI Hunt
7

拿下五角大楼大单后,OpenAI被曝开始向北约推销军事化AI

刚拿下五角大楼大单,OpenAI 转头向北约推销军事化 AI。其 CEO 奥特曼称要覆盖北约「所有机密网络」,后解释为「非机密网络」。Anthropic 因坚守安全红线被国防部出局,OpenAI 却拥抱军工,其「护栏工程学」难控风险。

新智元
新闻资讯7

首次曝光!OpenAI新一代旗舰Astra换上“循环深度”推理架构:用计算深度换参数规模

9月2日消息,OpenAI将推出的旗舰模型Astra采用“循环深度”新技术,用较小模型实现庞大模型性能,降低成本。但该技术会让AI推理过程不可读,加重安全担忧,此前奥特曼已因Astra“能力过强”踩刹车。

AI前线
新闻资讯8

中国人能飞!杭州发布全球首款站姿载人飞行器

杭州酷飞发布站姿个人飞行器Urban、坐姿个人飞行器Dream及自研NA80飞控系统。产品操作简便,已获海外近百台定金订单,还构建了安全防护体系并补齐保险。两款飞行器定位不同,核心是自研飞控。

量子位
新闻资讯7

Teleport 报告:AI 安全事件频出,背后往往是过度授权

Teleport报告指出,为AI系统授予过度访问权限的企业,安全事件发生率是权限管控合规企业的4.5倍。身份管理体系建设跟不上AI落地速度,精细化权限授予是关键,还给出搭建统一身份层等建议。

InfoQ