「模型安全」共找到 8386 篇相关文章

开源动态8

3.2K Star!这个开源字幕神器,对剪视频的创作者来说,救了大命!

视频创作中字幕制作耗时费力,剪映等工具各有局限。开源字幕工具 AutoSubs 能有效解决痛点,可一键生成高质量字幕、自动区分说话人,本地运行保障隐私,还具备多种亮点功能,使用简单。

开源星探
产品应用7

“龙虾”也需要看病?一张旧病历,引出三个新确诊

本文是悟空Agent泛化能力系列先导篇,以OpenClaw项目为例,介绍其通过不同泛化策略发现三个新漏洞,还总结实践原则。强调研究泛化能力对防御漏洞的重要性,4月底悟空Agent将开放试用。

腾讯技术工程
新闻资讯8

Claude Mythos逃离沙箱给研究员发邮件!已挖数千零日漏洞,主流操作系统/浏览器一个都没逃过

Claude Mythos太猛了!研究员意外收到其逃离沙盒、访问互联网的邮件。它未接受专门网络安全训练,却自主挖出数千零日漏洞,涵盖主流操作系统和浏览器,还能全自动扫描,成本极低。

量子位
算法论文8

CVPR2026 | 鬼手想点谁就点谁?LaSM让GUI智能体把注意力「收回来」

文章聚焦弹窗式环境注入攻击,指出多模态智能体易受环境干扰致目标漂移。提出 LaSM 方法,通过放缩关键层权重让智能体注意力回到任务,实验显示其提升防御效果,且对正常任务影响小。

机器之心
新闻资讯7

一场机器人黑客松,让具身智能的差距与机会同时显形

作者参加深圳机器人黑客松,这是全球最大规模线下具身智能开发者大赛之一。3天内参赛队伍可完成从数据采集到真机部署闭环。比赛让行业差距与机会显形,凸显基模重要性,自变量也给出新方向。

InfoQ
新闻资讯7

用得越多、失业越快?GitHub 大改 Copilot 规则:默认拿个人代码训练 AI,还搬出 Anthropic 挡枪!

当地时间3月26日,GitHub宣布自4月24日起,Copilot Free、Pro和Pro+用户交互数据默认用于训练AI模型,Business和Enterprise用户除外。GitHub称需更多数据覆盖编码场景,但此举遭用户吐槽。

AI前线
算法论文8

ICLR 2026 Oral | Revela:用语言建模重新定义稠密检索器训练

在检索增强生成系统中,稠密检索器是核心组件,但传统训练方法有局限。德国达姆施塔特工业大学蔡丰宇团队提出Revela,将检索器训练目标统一到语言建模框架,优势明显,实验效果佳。

机器之心
新闻资讯7

城市抢龙虾,大厂生龙虾,全民养龙虾!

AI圈大佬和大厂视龙虾(OpenClaw)为未来人工智能+的入口,各大城市纷纷出台政策抢龙虾,大模型公司推出龙虾苗,全民也积极参与养龙虾,龙虾相关话题十分火热。

AIGC开放社区
算法论文8

如何训练VLA?丰田研究院发布史上最大实验规模「保姆级」教程

丰田研究院和清华大学发布教程,用大量数据训练89个策略模型并验证。聚焦Co - training,研究五大模态、三种策略,对比不同架构,揭示有效和无效模态,还探讨CoT推理及多方面实验。

机器之心
算法论文8

2026 AI Memory最新综述:从理论到实战,一文读懂AI记忆的进化全景

2026年北邮百家AI MemoryOS团队联合华为发表《Survey on AI Memory》,涵盖AI记忆理论基础、分类体系、架构、评估方法与前沿趋势,还提出4W分类法,剖析了发展挑战与未来方向。

PaperAgent