认知安全」共找到 1194 篇相关文章

新闻资讯8

前沿模型被曝年度重大漏洞:加密思维链可被轻松提取,GPT,Claude,Gemini 无一幸免

一篇 116 页论文揭示前沿模型思维链重大安全漏洞,Anthropic、OpenAI、Google 的 API 因架构问题,模型隐藏推理过程可通过两次 API 调用被大规模提取,还会带来多种安全威胁。

AGI Hunt
产品应用8

Marvis 实测:6 个 AI“牛马”扎根桌面之后

作者实测腾讯 Marvis,它能实现终端调度、多 Agent 协同、跨模态任务链执行等。虽在编码、审美等方面有不足,但定位安全实用,适合普通用户,体现 AI 助手从对话工具向执行系统转变。

腾讯技术工程
新闻资讯7

OpenAI与Anthropic罕见合作:竞争对手联手测试AI安全

OpenAI和Anthropic完成联合评估,用内部工具测对方模型并公开结果。测试覆盖指令层级、越狱等四大领域,还发现不少细节和道德困境情况。此次合作意义重大,为行业树立安全合作先例。

AGI Hunt
新闻资讯7

GPT-5系统提示词突遭泄露,17803 token曝光OpenAI小心思!

一份全新GPT - 5系统提示词在GitHub泄露,有17803 token。此提示词设计精细,覆盖用户对齐、拟人风格、输出质量等。还展示了通用关键要求、安全对齐等方面内容。

新智元
新闻资讯7

汽车MCU的“芯”浪潮

在汽车产业变革下,汽车MCU作为核心控制部件迎来创新升级。AI浪潮让其算力狂飙,架构革新提升集成度,同时安全成新重点。未来,汽车MCU将更智能高效,融合AI、创新架构、重视安全

芯师爷
新闻资讯7

Ilya曝光70页OpenAI绝密文件

《纽约客》披露Ilya偷拍的70页OpenAI机密文件,内容抓马。从董事会到微软高管,对奥特曼评价是撒谎成性。宫斗后奥特曼回宫,OpenAI安全承诺瓦解,20年前就有人看透他。

量子位
新闻资讯8

阅读7千万文章硅谷爆火:AI奇点已至,抛弃人类自我进化!

文章指出本月AI质变式飞跃,能独立完成复杂工作,递归自我提升循环已启动。如GPT - 5.3 - Codex有判断力和品位,AI构建自身进程加速。多数人认知滞后,作者给出应对建议,也提及AI带来创造机遇。

新智元
新闻资讯7

Anthropic 发布最新研究:LLM 展现初步自省迹象

Anthropic 最新研究表明,Claude 展现出真实但有限的内省能力,能在某种程度上识别自己内部状态。研究团队开发验证方法,通过概念注入等实验进行测试,还发现认知控制证据等,不过该能力有局限。

AGI Hunt
推荐文章7

AI 赋能宇宙文旅?3位艺术家让你“触摸”星空,体验前所未有的情绪价值!

文章介绍三位青年艺术家周天行、徐诚开、姚心玥探索宇宙文化沉浸式叙事,以VR、AI等技术构建新叙事方向。还回顾其演变历程,展望未来,阐述该叙事在认知、文明等维度的意义及产品畅想。

MANA新媒体艺术站
新闻资讯7

马斯克彻底向ASI投降!10年后万亿财富都将「归0」

2026年7月23日,马斯克接受《经济学人》总编专访,给出AI发展时间线,称5年内AI智力超人类总和,10年内金钱无意义。他曾是AI末日论者,如今态度转变,还提出AI安全治理方案。

新智元