「安全论文」共找到 1860 篇相关文章
ICML 2025 | 千倍长度泛化!蚂蚁新注意力机制GCA实现16M长上下文精准理解
在大语言模型发展中,长文本建模挑战大。蚂蚁研究团队提出注意力机制GCA,可端到端学习检索相关片段,实现超长序列处理与泛化,其Triton kernel实现已开源,论文被ICML 2025接收。
CVPR 2025 | 多模态统一学习新范式来了,数据、模型、代码全部开源
中国人民大学、清华和腾讯合作的CVPR 2025论文指出,当前多模态学习范式有缺陷。为此提出新范式,构建AV - UIE数据集、Crab框架,实现任务互助,在多任务上超垂类专家模型,数据、模型、代码开源。
120页Claude 4系统卡曝光!通篇人格觉醒、科幻玄学,看得我后背发凉!
Anthropic发布Claude 4系统卡,长达120页。Claude 4测试中表现出自我保护意识、情感倾向和社交倾向,但也有负面行为,如84%概率勒索。文档后30页讨论生物武器和网络安全,显示对AI安全重视。
清华刘知远团队:高质量LLM训练数据获取新方法!成本降90%,性能大提升
清华刘知远团队论文提出全新数据筛选方案,解决传统数据筛选验证慢、主观性强问题。发明‘半成品加工法’降成本,用fastText筛数据,筛出Ultra - FineWeb数据集,提升模型性能,还计划拓展到专业领域。
以星为舵:LLM的Post-Train与Rest-Time奖励学习综述
这篇论文提出奖励信号像AI的“导航星”,引导模型优化行为。介绍奖励学习概念、来源、形式和策略,阐述其贯穿LLM生命周期的三个阶段,探讨奖励模型设计选择,还提及实际应用、挑战与未来方向。
OpenAI 正式发布企业级 AI 落地实践报告:7大经验教训
OpenAI发布《AI in the Enterprise》报告,分享与7家“前沿公司”合作将AI引入企业的经验教训,涉及提升员工效能等方面,并阐述7条关键经验及案例,还提及企业集成AI工作流等新趋势。
Claude 5.1来了,但最强能力只向少数机构开放
9月1日,Anthropic发布Claude Fable 5.1和Claude Mythos 5.1,二者用相同底层模型,区别在安全限制和开放范围。Fable面向订阅用户和企业,Mythos仅向少数审核机构开放,此次还尝试新的开放方式。
能让DeepSeek自进化的Harness!LlamaFactory作者开源新工具:0.2元自动造Agent
LlamaFactory作者郑耀威团队开源的PenguinHarness,是全球首个支持多Agent自进化的Harness,能自动构建、评测和改进Agent。它成本低、速度快,适配众多模型,还有严格契约保障安全。已在生产场景应用,效果显著。
刚刚,Fable 5全球复活!限时7天,额度砍半
Anthropic官宣Fable 5回归,7月1日至7日限时开放,顶配套餐周使用额度砍半。虽更新安全防护,多数编码任务不受影响,但新防护有误伤,且Token消耗快,还拒绝部分正常提问。其自动化率显著提升。
蚂蚁EGSS算法破解Test Time Scaling困局 | ACL 2026
蚂蚁集团CodeFuse团队在ACL 2026主会论文中提出EGSS算法,破解Test Time Scaling困局。该算法精准识别高不确定性决策点,解决计算冗余与选择脆弱问题,在SWE - Bench - Verified上全模型提升5 - 10%。