「安全风险」共找到 1224 篇相关文章
提示词压缩竟成大模型新漏洞?港科大提出黑盒攻击框架COMA | ASE 2026
香港科技大学研究发现,大模型的“提示词压缩”模块会重写系统安全边界,成为新攻击面。团队提出“对抗性信息损失”概念和COMA攻击框架,实验有效,还给出隔离压缩防御方案。
读代码前先跑5个「Git命令」?方法火了,网友却吵起来了
文章介绍Ally Piechowski观点,读新代码库前可先运行五个Git命令,了解项目情况。不过网友对此有争议,认为Git数据不一定可靠,还可能过度解读。
Pinterest 部署生产级模型上下文协议生态系统,赋能 AI 智能体工作流
Pinterest 工程团队搭建内部模型上下文协议(MCP)生态系统,驱动 AI 智能体,实现工程任务自动化。架构上线生产级服务器等,替换零散对接方式,让语言模型调用工具、访问数据,还能执行多种任务。
Claude实名认证引众怒!强制验证是为了更精准封号,Opus自己都看不下去
Claude新规则要求实名认证,引发网友不满。身份验证并非继续使用服务的通行证,反成封号预警。15岁天才程序员因未成年被封账号,Claude Opus 4.6也否定自家KYC规则。
GitHub 已被各类Agent霸榜,今天挑选5个高star Agent
文章挑选5个GitHub高star Agent项目。如Hermes Agent是开源自改进AI Agent,有自主技能创建等特性;GitNexus是纯浏览器端代码智能工具;Shannon是白盒AI渗透测试工具等。
又走一个!OpenAI研究VP离职,转投Anthropic做RL研究员
OpenAI研究副总裁Max Schwarzer宣布离职,转投Anthropic做RL研究员。他曾主导o1、o3和GPT - 5系列post - training,因渴望回归一线研究而离开。OpenAI近年人才流失严重,而Anthropic虽面临与五角大楼交锋危机,但仍吸引人才。
氛围编程将死!谷歌总监警告:只会写Prompt的程序员,2026年将被淘汰
谷歌云AI总监Addy Osmani称AI编程进入下半场,氛围编程将被取代。AI能提升生产力,但无质量保证,人类专业判断才是关键。他还提出工作模式,强调开发者要结合AI提升能力。
Veo何止生成视频:DeepMind正在用它模拟整个机器人世界
通用型机器人策略发展带来挑战,传统评估方法有局限,前沿视频模型虽有潜力但面临困难。Google DeepMind团队提出基于Veo的机器人策略评估系统,经实验验证有效,展示了视频仿真评估的可行路径。
AI仅凭“自信”学会推理,浙大校友复刻DeepSeek长思维链涌现,强化学习无需外部奖励信号
UC Berkeley团队提出新训练方法Intuitor,大模型无需接触真实答案,仅优化自身信心就能学会复杂推理。该方法无需外部奖励信号或标注数据,用模型自身置信程度作内在奖励信号,在多任务表现良好。
全球首例!科学家将腿部肌肉线粒体注入盲人眼球,瞳孔光反射短暂恢复
对于视神经严重受损致盲,临床缺有效修复手段。美国研究人员从失明女性腿部肌肉提取线粒体注入其双眼,初步验证了自体线粒体眼内移植的安全性,患者眼部有生理变化,但未恢复视力,实验疑问多。