「拟像概念」共找到 888 篇相关文章
可攻可防,越狱成功率近90%!六大主流模型全中招 | EMNLP'25
研究人员聚焦大型语言模型(LLMs)安全漏洞,提出全新越狱攻击范式SCP与防御策略POSD。SCP基于DTD机制,在6个主流模型上平均攻击成功率达87.23%;POSD能有效抵御攻击,还提升模型泛化能力。
开源AI黑客Agent,自动检查代码漏洞并修复,离AI编程的全流程自动化不远了。
开源的AI Agent能自动查代码漏洞并修复,是集自动化渗透等功能于一体的安全测试平台。Strix作为开源AI安全测试工具,无需手动渗透测试,支持多类型安全评估,功能强大。
AISPM与AI防火墙--是产品不同,还是名字不同?
文章探讨AISPM与AI防火墙是产品不同还是名字不同。介绍xSPM概念及AISPM定义,分析国内AI防火墙应对威胁能力,指出AISPM更强调过程管理,未来AISPM对维护AI安全至关重要。
GUI 精准定位新 SoTA:LASER 让模型从“看全图”走向“锁重点”
多模态大模型在高分辨率、元素密集的 GUI 场景易误判。苏州大学 OpenNLG 团队提出 LASER 方法,让模型学会主动推理,通过关键区域聚焦等提升定位精度,在基准测试中表现出色。
光刻机巨头ASML,108亿控股了一家大模型公司
光刻机巨头ASML领投法国AI明星公司Mistral AI的C轮融资,砸13亿欧元成第一大股东,推高其估值至100亿欧元。Mistral开源与商业化并行,ASML投资或提升光刻机效能。
大模型解数学题是真懂还是 “死记硬背”?|首个反例驱动的数学推理基准揭穿 “刷题式假象”!
随着大语言模型在数学领域应用渐广,其是否真具备数学推理能力成焦点。清华等团队提出反例推理评测基准COUNTERMATH,测试20+主流模型,结果不佳,而小样本微调能显著提升模型能力。
氛围编程行不通!CTO们集体炮轰AI编程:不是失业,而是失控
CTO们认为氛围编程是灾难,如代码上线后出现系统崩溃、用户权限漏洞等问题。Augment Code的Chris Kelly演讲指出,AI写代码有局限,软件工程师要做决策,还给出写让AI接手代码的建议。
7年了,OpenAI官方给出五代GPT对比,网友却怀念起「狂野」初代
OpenAI总裁分享给定相同提示下,GPT-1到GPT-5输出的差异,对比显示GPT系列在知识储备等方面不断进步,但网友看法不一,不少人怀念初代模型的‘狂野’。
Cursor or Claude Code ?— 这道题怎么选
文章深度对比Cursor和Claude Code两款AI编程工具,介绍其核心功能、适用场景。经案例分析,指出Cursor快但草率,Claude Code慢却精准。还给出使用心得,建议开发者依任务灵活选择或结合使用。
Demis Hassabis揭秘世界模型Genie 3的真正意义:为AGI打造无限“虚拟子宫”
Google DeepMind CEO Demis Hassabis与产品负责人深度对谈,爆料将游戏智能体SIMA放入Genie 3生成世界训练,探讨AI从游戏到思考系统的演进、Genie 3意义及AGI评估挑战,还提及与Kaggle合作推游戏竞技场。