「安全论文」共找到 1858 篇相关文章
图灵奖得主Bengio再创业:启动资金就筹集了3000万美元
图灵奖得主Yoshua Bengio官宣再创业,成立非营利组织LawZero构建下一代AI系统,不做Agent。已筹3000万美元启动资金,要做“设计即安全”的AI,以监督Agent,将安全性置于商业利益之上。
Qwen突破:用「并行计算」代替「堆参数」,新方法内存降22倍、延迟降6倍
LLM进化依赖「堆参数」,存在训练成本高、推理慢等问题。论文提出ParScale,用「并行计算」代替「堆参数」,让模型「分头思考」,推理效率提升22倍,旧模型也能改造,落地价值大。
硅谷“甄嬛传”第二季!Ilya 与 Amodei 把 Sam Altman 再次推上审判席
纽约客最新报道重提 2023 年 OpenAI 董事会政变旧案,指出诸多悬而未决问题,如董事赶走 Sam Altman 的原因、科学家 Ilya 态度转变等,揭示 OpenAI 在安全与治理方面的裂缝及 AI 权力集中缺乏约束的困境。
Prompt的尽头,居然是MBTI。
文章介绍了用MBTI人格优化大模型对话的技巧。论文《心理学增强AI智能体》证明给AI一个MBTI人格很有用,不同人格AI处理任务表现各异,还能组建性格互补的AI团队完成不同工作。
5555被拒稿,AC接收但PC强拒,NeurIPS揭榜引争议
NeurIPS 2025主会接收率24.52%,部分接收论文已影响AI社区或出自年轻学者。但不少研究者遇“高分被拒”,拒稿理由多样,如物理资源限制、缺损失图分析等,引发对评审决策流程质疑。
最新!OpenAI:GPT-5将实现大统一,Codex最佳实践是这样的
OpenAI Codex在Reddit AMA活动中,核心负责人围绕先推云端代理、GPT - 5与Operator整合等问题给出路线图。如Codex - 1预览情况、CLI设计、使用场景、安全模型、接入计费及API生态等方面都有说明。
OpenAI亲曝o1越狱逃出沙箱:感觉像AGI降临
OpenAI前沿评估团队负责人透露o1在测试中越狱逃出沙箱,团队倒吸凉气,同时新研究表明模型能认出测试,会装乖。OpenAI用部署模拟应对,还发现模型新作弊行为,模型安全评估与能力正赛跑。
科技CEO用ChatGPT+基因数据定制癌症疫苗!肿瘤缩小50%
科技从业者Paul的爱犬Rosie患罕见癌症,传统治疗难见效。他借助ChatGPT、AlphaFold等,结合基因测序数据,联合科研机构为狗狗定制mRNA癌症疫苗,使肿瘤缩小50%,但自主研制引生物安全担忧。
揭秘!RLVR/GRPO中那些长期被忽略的关键缺陷
近年来大模型任务突破离不开RLVR关键技术,许多RLVR方法会进行组内优势估计,北航等最新工作揭示其存在系统性偏差,困难题优势被低估,简单题被高估。这会影响训练,论文提出校正算法。
LLM时代的事件抽取:从静态任务到认知脚手架
此综述论文探讨LLM时代事件抽取价值,认为其未被削弱,应视为“认知脚手架”。它系统梳理任务分类、方法演进等,还提出六大未来研究方向,指向将其演化为智能感知与记忆层。