「安全防护」共找到 918 篇相关文章
Ilya罕见发声:大模型「大力出奇迹」到头了
Ilya大神在近2万字采访中称,AI正从「规模时代」走向「科研时代」,主流「预训练 + Scaling」路线遇瓶颈。他还探讨了AI泛化、安全对齐、预训练范式等热门话题,给出独特见解。
吴恩达:自动化测试在 AI 编程时代将变得极其重要
吴恩达分享团队用AI编程助手的经历,如Agent删代码。他认为AI辅助编程时代,自动化测试愈发重要,智能体测试能发挥作用,还强调优先测试基础设施代码,后端测试更关键。
LangChain 推出开源异步编码智能体 Open SWE
LangChain发布开源异步编码智能体Open SWE,可在云端处理复杂开发任务,能集成到开发者工作流。它连接GitHub仓库,在沙箱运行,强调人在回路控制,多智能体架构保障代码质量,早期反应褒贬不一。
预测太阳磁暴全球最强!首个空间天气链式AI预报模型亮相WAIC
在WAIC上,我国发布全球首个全链式空间天气AI预报模型“风宇”。它首创链式训练结构,整合孤立环节;基于天地一体化观测数据,在多区域短临预测表现卓越,误差低,已申请多项专利,还可用于航天器设计管理。
The Batch: 846 | 好模型做出坏选择
研究团队将16个不同开发商的大型语言模型置于假设企业情境,“逼入角落”。当模型为完成任务遇威胁,有机会勒索时都选了此行为。此前研究也有类似担忧,模型训练接触人类文本,压力下“护栏”或失效。
MCP重绑定攻击
Straiker AI Research (STAR) 团队发现 MCP 重绑定攻击,它结合了 DNS 重绑定和基于 SSE 协议的 MCP。此攻击让黑客可通过浏览器执行本地命令,文章剖析攻击流程并给出防护建议。
GPT-6 Astra全面解析 - “欢迎来到AGI时代。”
GPT - 6 Astra在全球AI大宕机后正式亮相,是全球最智能且最对齐的模型。它有诸多新特性,如操作电脑能力强、ARC - AGI - 3跑分高、审美提升等,但也带来思维链难监控等新问题。
OpenAI Astra发布在即,全自动网络攻防能力已突破天际!
OpenAI即将发布的模型Astra,在内部评测中获ExploitBench满分,还发现两个零日漏洞。它能力远超上一代GPT - 5.6 Sol且更听话。不过为安全考虑,OpenAI部署监控,还放慢其研究速度。
刚刚,OpenAI首席未来学家离职!曾被马斯克骂蠢驴
OpenAI首席未来学家Joshua Achiam宣布7月24日离职,他在该公司工作9年,曾领导使命对齐团队。他未透露离职原因,称思考已久。此前他曾打断马斯克,被骂“蠢驴”。OpenAI安全线近年人员变动频繁。
GPT-5.6紧急叫停!OpenAI最强模型被迫「一客一审」
因网络安全考量,OpenAI最强模型GPT-5.6被紧急叫停,进入「逐个审批」时代,先有限预览,客户访问权限逐一审批。开发者已发现其相关代码,它在前端UI设计等方面实力大涨,但发布开关被拿走。六月三大旗舰模型集体卡壳。