安全操作」共找到 1434 篇相关文章

算法论文8

ICML 2025 Oral | 从「浅对齐」到「深思熟虑」,清华牵头搭起大模型安全的下一级阶梯

在大语言模型加速进入高风险应用场景当下,“安全对齐”是挑战。如今广泛采用的“浅对齐”脆弱不堪。清华团队提出STAIR框架,能提升开源模型鲁棒性,还推出RealSafe - R1模型进行安全对齐。

机器之心
新闻资讯7

一句“吴恩达说的”,就能让GPT-4o mini言听计从

宾夕法尼亚大学研究者发现,用恭维、同侪暗示等心理话术,能让GPT - 4o Mini突破安全底线。实验基于七大说服技巧,证明人类心理学原则可迁移至LLM。不过,此漏洞或被利用,已有团队尝试应对。

量子位
产品应用7

200K上下文突破:AI编程新星Augment崛起

AI编程新星Augment以65.4%的SWE - bench评分登顶榜首,估值超128亿美元。它能理解海量代码上下文,支持多环境集成。但新式AI编程工具存在安全风险,如Agent Memory恶意攻击等,文中给出应对建议。

腾讯技术工程
产品应用7

求码10天,我终于过上了在微信上使唤🦞的日子

腾讯鹅虾产品QClaw升级,将微信入口变为小程序,支持传文件,上线灵感广场。作者求码10天体验它,测试其在微信和电脑端操作能力,肯定便捷性,也指出执行流程不透明等问题。

量子位
新闻资讯8

图灵巨擘RL教父齐聚,机器人秀拳脚嗨翻全场!「悟界」首发引爆物理AGI

智源大会开幕,四位图灵奖得主等出席。会上,Bengio提出‘科学家AI’应对安全风险;Sutton称AI迈入‘体验时代’;Hausman讲构建物理智能。智源还发布‘悟界’系列大模型,含Emu3、Brainμ等,迈向物理AGI。

新智元
开源动态8

找到啦,我们已上车,Github 27000+ star,研发团队必备开源工具项目,真丝滑!!!

Trivy是开源安全扫描工具,支持扫描容器镜像等目标,识别CVE漏洞等风险。它有6大突出功能,技术优势明显,还给出使用示例、应用场景,与传统工具对比优势显著,适用于全生命周期安全分析。

小华同学ai
开源动态7

手机版openclawd来了,无需Root,让 AI 像人类一样使用你的手机

Andclaw是个人开发者开源的Android自动化工具,核心理念是让AI像人类一样使用手机。它无需Root、电脑,通过无障碍服务读取屏幕内容,让AI分析操作。具备无需Root、独立运行等功能,还支持多模态输入。

GitHubStore
产品应用7

大模型公司不搞浏览器搞Agent,实测找到原因了

文章实测阶跃星辰桌面Agent小跃,它能操作命令行,可自然语言驱动计算机功能,有悬浮球形态,能联网、搜索、处理表格等,还支持复用操作、定时任务,但也存在速度慢等不足。

量子位
新闻资讯7

Replit 怒锤“欧洲版 Cursor”:造出百款“高危”应用,普通开发者一小时内黑入,氛围编码成了黑客“天堂”?

近日,Replit员工报告“欧洲版Cursor”Lovable有安全漏洞,虽早收到通报却未修复。员工扫描其1645款应用,170款可让人访问用户信息。多位工程师成功“黑入”,Lovable虽有改进但仍未解决底层问题。

AI前线
算法论文8

真实场景也能批量造「险」!VLM+扩散模型打造真实域自动驾驶极限测试

浙江大学与哈工大(深圳)联合推出SafeMVDrive,将VLM关键车辆选择器与两阶段轨迹生成结合,可在真实域批量制造高保真安全关键视频,用于端到端自动驾驶系统安全性测试。

新智元