判断检测」共找到 415 篇相关文章

开源动态7

警惕!“养龙虾”风险,一键给你的Openclaw做安全体检

OpenClaw在短时间内登顶GitHub开源榜首,国内企业纷纷部署。但它存在安全隐患,如漏洞、隐私风险等。朱雀实验室联合腾讯云EdgeOne推出「OpenClaw安全体检」功能,可自动完成全面体检与风险评估。

腾讯技术工程
算法论文7

DeepSeek-OCR是「长文本理解」未来方向?中科院新基准VTCBench给出答案

DeepSeek - OCR的VTC技术可实现高压缩率,降低长文本处理成本。但视觉语言模型能否理解压缩信息存疑,中科院等推出VTCBench评估,测试模型认知极限,还推出VTCBench - Wild检测鲁棒性。

机器之心
算法论文8

LLM越狱攻击的威胁被系统性高估? 基于分解式评分的「越狱评估新范式」出炉

目前LLM越狱攻击评估常依赖间接指标或LLM宏观判断,易有偏差。德国、中国等研究团队提出JADES框架,用分解式评分机制,揭示过去高估越狱攻击威胁,为评估建新标准。

机器之心
新闻资讯8

250份文档投毒,一举攻陷万亿LLM!Anthropic新作紧急预警

Anthropic最新研究揭示,仅250篇恶意网页就能让大模型“中毒”,遇特定触发词会崩溃。研究还设计DoS型后门攻击,验证不同规模模型攻击效果。同时指出AI开放性易被操控,而Anthropic注重安全,有“防爆层思维”。

新智元
产品应用8

刚刚,Claude Code推出自动安全审查功能,顺便干掉了10家安全创业

Claude Code推出自动化安全审查功能,有 `/security-review` 命令和GitHub Actions集成两大核心能力,能检测多种漏洞,与传统SAST工具比优势明显,还能解释问题并提供修复建议。

AGI Hunt
新闻资讯7

14%论文都有AI代写?Nature:每7篇就有1篇藏有ChatGPT特征词

据Nature报道,研究发现在2024年PubMed上超20万篇生物医学研究摘要频繁出现LLM特征词。部分国家和学科中,AI辅助写作比例超五分之一且趋势上升,作者还会引导LLM规避痕迹。

量子位
推荐文章8

吴恩达来信:AI项目时间紧任务重?不妨简化你的构想

吴恩达分享在AI项目中获取实践经验的技巧,若时间有限,可缩小项目规模。他以构建“听众模拟器”为例,展示如何在有限时间利用编程助手完成基础版本,还能获反馈推进项目。

DeeplearningAI
产品应用7

AI又来带货了!字节推出DreamActor-H1自动对齐手势和商品

在电商和数字营销领域,现有框架呈现效果不佳。字节推出DreamActor - H1框架,基于扩散变换器,集成Seaweed - 7B模型,能生成高保真人机交互视频,有效果突破但也存在局限。

带你学AI
算法论文8

开源模型竟被用于窃取下游微调数据?清华团队揭秘开源微调范式新型隐藏安全风险

清华、墨尔本大学团队研究指出,基于开源模型微调专有模型存在新型隐藏安全风险,开源模型发布者可埋后门窃取下游微调数据,新风险难检测、危害大,目前攻防方法待改进。

机器之心
推荐文章8

Anthropic发布AI原生创业秘籍:手把手教你怎么烧Token创业

Anthropic发布36页AI原生初创企业操作手册,将创业精准拆解为四阶段,剖析如何用Claude Code构建商业护城河。介绍各阶段任务、退出条件、常遇问题及应对策略,强调创始人判断能力重要性。

AIGC开放社区