「网络安全模型」共找到 8399 篇相关文章
高效Agents的尽头是,Harness
文章指出玩Agent久了会出现问题,很多人简单将其视为“模型+工具”组合远远不够。以OpenDev为例,介绍了Harness架构,包括核心理念、扩展ReAct循环、上下文工程等,还提及安全架构、多模型路由等内容。
挑战 Claude Code,9.5 万星!又一款开源 AI 编程神器火了
开源AI编程工具OpenCode亮相,具备原生终端界面、多会话支持,兼容75种以上模型,提供桌面版和IDE插件。它允许沿用付费订阅,内置免费模型,与多种LSP服务器整合,适配多种编辑器,采用‘隐私优先’架构设计。
OpenAI和Anthropic费尽心机加密的思维链,竟然能被轻松提取?
围绕大模型蒸馏争议已久,此前外部团队难获闭源模型完整推理。8 月 10 日研究者公开方法,可让弱模型读取旗舰模型密文并输出推理,还发现公开智能体轨迹存在隐私泄露问题,不过未为蒸馏指控提供决定性证据。
什么样的龙虾,才是「一人公司」的心头好?
AI时代,OPC概念火热,但过往大模型和Agent难落地。面壁智能官宣EdgeClaw Box,采用端云两栖架构,安全高效,适配多款硬件,可插电即用,还能降成本、保障数据安全,集成多种Skills,助力OPC提效。
美国解除Claude禁令,Fable 5与Mythos 5即将恢复访问
美国商务部解除针对Claude Fable 5和Claude Mythos 5的出口管制,Anthropic将恢复两款模型访问权限。此前因安全担忧模型被限制,政策逐步松动后现整体解禁,Anthropic还发布了Claude Sonnet 5。
Claude Mythos官宣!性能碾压Opus 4.6,因太危险遭「囚禁」
Anthropic官宣最强模型Claude Mythos预览版,性能全方位碾压Opus 4.6。但它存在致命缺陷,攻击安全漏洞能力超多数黑客。Anthropic暂不向公众开放,联合巨头开展安全计划,称需各方共筑网络安全。
刚刚!OpenAI与Anthropic CEO罕见同台,黄仁勋当场唱反调:AI到底要不要踩刹车?
Salesforce Dreamforce 2026大会上,OpenAI、Anthropic、英伟达三大AI巨头CEO罕见同台,围绕AI发展是否需要踩刹车展开激烈论战,各方立场背后暗藏产业利益博弈,头部模型厂商已密谈行业安全协同。
突发!OpenAI紧急暂停GPT-6训练
OpenAI奥特曼官宣暂停下一代旗舰模型强化学习训练两周,原因是确保安全等标准跟上能力水平。触发因素有Hugging Face事故和Astra达安全红线,后续将让AI监管AI,加固三道安全防线。
OpenAI公开4+10条保命指南,专防AI自动化攻击
OpenAI联合创始人兼总裁Greg Brockman在Blog中警告,前沿AI Agent能自主找漏洞并发动网络攻击,AI降低攻击门槛,防御端却未跟上。他分享OpenAI四项安全措施及防御者十项举措,呼吁行业共建安全生态。
LLM加RL遭质疑:故意用错奖励,数学基准也显著提升,AI圈炸了
华盛顿大学等机构论文引爆AI界,其发现用虚假奖励训练Qwen2.5-Math-7B模型,也能提高MATH - 500成绩。虚假奖励对Qwen模型有效,但在其他模型上有限,凸显RLVR有效性与模型能力有关。