「AI安全研究」共找到 10992 篇相关文章
首个英文原生「弱智吧」!逻辑谬误数据集与生成框架来了 | AAAI'26
研究发现大模型判断逻辑谬误易误报正常句子,但分类能力较强。研究人员构建英文逻辑谬误基准SMARTYPAT - BENCH,开发生成框架SMARTYPAT,为大模型逻辑评估提供新思路,可用于多领域。
忍无可忍,LeCun离职!Meta市值应声蒸发1400亿
金融时报消息,LeCun向同事透露离职Meta计划,下一步打算创业。消息致Meta市值盘前蒸发1400多亿人民币。LeCun受尽挤兑,与Meta有路线分歧,其离开标志Meta‘学院派’研究黄金时代结束。
原来我每天玩手机是在给平台免费打工
我们身处精心设计的数字体系,大型企业规模化后将运营成本转嫁给使用者和创作者。平台要求内容‘垂直’、鼓励‘模仿’,AI时代更直接收割全网公开内容,这是一场不动声色的掠夺。
创始人“背刺”员工获财富自由,Devin 接盘火速兑现员工期权,华人 CEO 暗讽:做个人吧!
当地时间 7 月 14 日,Cognition 宣布收购 Windsurf。此前 Windsurf 收购案波折不断,创始人带部分人去谷歌,遭网友吐槽“背刺”员工。Devin 接盘后保障员工权益,还引发对 AI 编程工具竞争的讨论。
让ChatGPT连读“A”,直接崩溃到念广告词,网友:拿付费用户做测试呢?
ChatGPT付费用户体验高级语音模式时遇怪事,正常聊寿司时突然插播广告,连读“A”也会如此。网友猜测是广告插入或“幻觉”,OpenAI技术人员称是幻觉,而国产AI无此问题。
一个App管好所有Agent技能,Chops来了
Chops是一款macOS应用,能自动发现所有AI coding agent的技能文件,支持Claude Code、Cursor等工具。功能丰富,技术栈纯粹,需macOS 15 Sequoia及以上,下载地址和文档在GitHub。
Rust 版 OpenClaw 来了!单文件、零依赖、强沙箱、自带“故障转移”!
Rust版OpenClaw——Moltis问世。其零依赖、全沙箱、反泄露,以Rust架构带来多好处,还统一模型接口,支持本地模型离线运行,安全和存储机制出色,是面向生产的Agent框架。
OpenAI大佬爆料:打字太慢拖后腿,人类竟成了AGI短板?
OpenAI Codex负责人Alexander Embiricos称人类打字速度拖慢AGI进展。奥特曼、Amodei、马斯克等大佬也有类似看法。Embiricos认为要让AI自主审查工作,2026年或迎AGI。
LLM越狱攻击的威胁被系统性高估? 基于分解式评分的「越狱评估新范式」出炉
目前LLM越狱攻击评估常依赖间接指标或LLM宏观判断,易有偏差。德国、中国等研究团队提出JADES框架,用分解式评分机制,揭示过去高估越狱攻击威胁,为评估建新标准。
最强开源VLM“华山论剑”丨多模态专场直播
近期Intern - S1等多模态大模型开源,引发热烈讨论。本周四OpenMMLab等发起AI Insight多模态专场,邀请模型核心研发者分享,涵盖模型设计思路、实践经验等,还有圆桌对谈。