「大模型安全」共找到 9706 篇相关文章
记忆奇点来临!人类三十万年遗忘被哈佛神经科学家终结
哈佛医学院神经科学家 Gabriel Kreiman 推出 Engramme,旨在赋予人类完美且无限的记忆。它能在特定场景下主动推送相关记忆,构建了大记忆模型,有深厚研究积累,已开放 beta 版申请。
谷歌月Tokens消耗量领跑全球了:1300000000000000(别数了是千万亿)
谷歌月处理Tokens用量达1.3千万亿,较一年前的9.7万亿大幅增长。横向对比,谷歌在该指标上远超微软等大厂。Tokens消耗量可衡量模型多方面能力,谷歌为行业树立新标杆。
刚刚,Anthropic王炸Claude泄露!全面碾压Opus 4.6引爆全网
因「人为配置」错误,Anthropic最强模型Claude Mythos细节泄露。它编程、推理能力超Claude Opus 4.6,还具备网络攻防能力,但也带来安全风险,Anthropic因担心被黑客利用暂未发布。
教育行业首个AI Agent落地!斑马口语「超人类外教」诞生
教育行业首个AI Agent落地,斑马口语推出「超人类外教」。它有「人」味,能灵活交流、共情,背靠猿力大模型,有记忆能力,性价比高,推动优质口语教育,或重塑教育行业。
为 Agentic AI 的黎明构建地基
文章指出大语言模型虽耀眼,但企业级解决方案需坚实数字底座。在 Agentic AI 时代,数据范式、基础设施哲学都要重塑,智能体模式崛起带来挑战与机遇,技术决策者要做好底座构建。
计算机安全第一人宋晓冬,加入Meta
本周四,UC Berkeley 计算机教授宋晓冬宣布加入 Meta 超级智能实验室,任 AI 研究副总裁。她是计算机安全领域顶尖学者,其团队也一同加入。此外,AI 推理大牛 Denny Zhou 数月前也已加入 Meta。
AI生成操作系统新突破!上海交大提出文件系统开发新范式:从此只需写规约
上海交大IPADS实验室团队在自动生成操作系统核心组件上有新突破。面对大模型生成操作系统的难题,提出SysSpec新范式,以规约指导生成,并配套工具链,构建SpecFS文件系统,开发效率提升3 - 5倍。
「重要性采样」并不「重要」?快手清华ASPO攻克重要性采样权重错配
快手与清华合作团队发现大语言模型结果监督强化学习中,重要性采样机制“失灵”,存在权重错配现象。为此提出算法ASPO,在多基准测试中展现优势,训练更稳定。
深夜突袭!谷歌Gemini 2.5 Pro更新蝉联榜一:推理超越o3,编程超越opus4
深夜谷歌对Gemini 2.5 Pro模型重大更新,在编码、推理等测试中超越o3,几周内成稳定版。其价格优势大,还增加思考预算,输出风格和结构改进,用户实测反馈佳,但发布不久被越狱攻击。
让AI自己“炼数据”!DataChef开源:用强化学习自动生成LLM数据配方
上海人工智能实验室联合复旦大学开源DataChef,它能通过在线强化学习自动生成LLM数据配方。实验显示其能力逼近Gemini - 3 - Pro,超越人类专家设计算法,解决传统数据工程难题,推动大模型数据工程迈向新范式。