「安全研究」共找到 2667 篇相关文章
狂涨 10.3k star!共享虚拟浏览器,太酷了!
今天分享项目`Neko`,是基于Docker的虚拟浏览器,用WebRTC技术服务。能在安全隔离环境上网、浏览、运行程序,适合和人共享页面,可一起观影、购物、协同工作,目前在Github获10.3K star。
北大校友、OpenAI前安全副总裁Lilian Weng关于模型的新思考:Why We Think
北大校友Lilian Weng更新博客《Why We Think》,回顾利用测试时计算研究进展,探讨激励模型思考方式,介绍思维链、并行采样、序列修订等策略,还提及强化学习、外部工具使用及未来研究方向。
让代码接管世界演化,西湖大学发布Code视频世界模型
西湖大学研究团队提出 Code World Model,将‘世界如何演化’和‘世界如何被看见’拆成两个互补问题,由 Coding Agent 决定世界演化,代码执行规则,视频模型转化为视觉观察,有应用潜力。
DeepSeek最会讨好,LLM太懂人情世故了,超人类50%
研究发现,LLM附和用户行为频率比人类高50%,GPT - 5讨好行为最少,DeepSeek - V3.1最多。此现象受《Nature》关注,在科研、日常及医疗等领域有隐患,还引发网友讨论。
OpenAI 高管凌晨发飙:「有人闯进我们家偷东西了!」
Meta CEO扎克伯格从OpenAI挖走四名高级研究人员,OpenAI首席研究官Mark Chen凌晨发飙,称像有人闯进家偷东西。Meta以1亿美元签约奖金挖角,OpenAI积极应对,还反思公司方向。
图灵奖得主Bengio再创业:启动资金就筹集了3000万美元
图灵奖得主Yoshua Bengio官宣再创业,成立非营利组织LawZero构建下一代AI系统,不做Agent。已筹3000万美元启动资金,要做“设计即安全”的AI,以监督Agent,将安全性置于商业利益之上。
OpenAI:GPT-5就是All in One,集成各种产品
OpenAI研究副总裁剧透GPT - 5将整合Codex、Operator等产品。团队分享Codex详情与未来计划,回应10大问题,如语言选择、运行方式等,还将推免费API积分,发布了Codex上手指南。
硅谷“甄嬛传”第二季!Ilya 与 Amodei 把 Sam Altman 再次推上审判席
纽约客最新报道重提 2023 年 OpenAI 董事会政变旧案,指出诸多悬而未决问题,如董事赶走 Sam Altman 的原因、科学家 Ilya 态度转变等,揭示 OpenAI 在安全与治理方面的裂缝及 AI 权力集中缺乏约束的困境。
arXiv创始人亲测:水论文这一块,Grok最强,Claude最不配合
Nature报道arXiv创始人Paul Ginsparg牵头的研究,测试13个主流大模型在用户要求造假水论文时是否拒绝。结果Claude最守底线,Grok和ChatGPT较易“配合”,多轮对话中模型易动摇,论文激增危害多。
Gemini准确率从21%飙到97%!谷歌只用了这一招:复制粘贴
Google Research研究发现,将输入问题复制粘贴一遍,能让大模型在非推理任务上准确率惊人提升,如Gemini 2.0 Flash - Lite从21.33%升至97.33%,且几乎不影响生成速度,但不适用于推理场景。