通用自适应攻击框架」共找到 987 篇相关文章

新闻资讯8

20美元,扒掉AI安全底裤!智能体2小时,攻破160亿美元巨头

红队安全创业公司CodeWall的AI智能体,花20美元Token费、运行2小时,自主选麦肯锡为目标,攻破其「数字大脑」Lilli,获4650万条聊天记录等读写权限,暴露AI安全隐患。

新智元
算法论文8

Think in Games:做一个在王者荣耀中会玩和思考的Agent

文章介绍论文《Think in Games: Learning to Reason in Games via Reinforcement Learning with Large Language Models》,指出当前AI在游戏领域面临的困境,提出TiG框架结合大语言模型与强化学习,打造既会做又会说的AI,实验验证其高效性。

深度学习自然语言处理
新闻资讯8

250份文档投毒,一举攻陷万亿LLM!Anthropic新作紧急预警

Anthropic最新研究揭示,仅250篇恶意网页就能让大模型“中毒”,遇特定触发词会崩溃。研究还设计DoS型后门攻击,验证不同规模模型攻击效果。同时指出AI开放性易被操控,而Anthropic注重安全,有“防爆层思维”。

新智元
算法论文7

清华唐杰新作:大模型能打掼蛋吗?

清华、北邮等团队联合研究表明大模型能打掼蛋等8种棋牌。不同模型在不同棋牌表现有差异,如GPT - 4o综合佳,GLM4是“全能型选手”。研究还探讨学习方法、模型性能影响因素及游戏间相互作用等。

量子位
新闻资讯7

刚刚,奥特曼家被炸了!

当地时间周五清晨,一名20岁男子向奥特曼旧金山的豪宅投掷燃烧弹,引发火灾,警方随后拘留了嫌疑人。奥特曼愤怒发声,深刻回应公众对AI的焦虑,反思自身,指出AI行业斗争源于AGI的权力诱惑。

新智元
算法论文8

DeepMind 最新研究:智能体就是世界模型!

DeepMind研究科学家Jon Richens团队在ICML 2025发表论文,从第一性原理证明智能体就是世界模型,回答了AI界多年的根本问题,还带来多个有趣推论,引发AI社区热烈讨论。

AGI Hunt
算法论文8

视频生成不再「断片」:OneStory给模型装上「选择性记忆」,跨镜头讲故事人物场景始终如一丨CVPR'26

多镜头视频生成挑战大,现有方法有局限。Meta与哥本哈根大学研究者提出OneStory,为多镜头视频生成建立跨镜头记忆机制,可生成连贯长视频,在复杂叙事中保持一致。

量子位
算法论文8

清华新研究,Nature+Science双杀!

清华大学李勇团队分析2.5亿篇科学文献,揭示AI for Science领域矛盾:虽助科学家个体加速,却致科学界群体注意力窄化。这由当前AI模型缺通用性导致,团队推出OmniScientist系统破局限。

量子位
算法论文7

见微知著:LLM 奖励建模的「Analytic Rubric」范式全面综述

该文是对LLM奖励建模的「Analytic Rubric」范式的全面综述。介绍了Rubric概念来源,指出传统奖励模型存在对齐风险,而Rubric RM在多方面取得平衡,还阐述其工作流、各维度研究情况及面临的挑战。

深度学习自然语言处理
产品应用7

分享10个你可能不知道的Claude Code隐藏命令。

作者分享10个Claude Code隐藏命令,如/btw可并行提问不污染上下文,/rewind能分别回退代码和对话等,还介绍快捷键,强调Claude Code更新快,建议关注更新动态。

数字生命卡兹克