「大模型安全」共找到 9591 篇相关文章
GPT-5刷屏吊胃口之际,英伟达发出暴论:小型语言模型才是未来
英伟达新论文指出,未来属于小型语言模型(SLM),挑战了智能体需用大型语言模型(LLM)的假设。SLM参数量低于100亿,有低延迟、低成本等优势,还给出从LLM到SLM迁移路线图。
求稳的安全IP,安谋科技如何守正出奇?|甲子光年
12月24日,安谋科技推出新一代SPU IP——“山海” S30FP/S30P,构建覆盖芯片底层至应用层的一栈式安全防护体系,有抗物理攻击强等五大亮点,能适配不同场景安全需求,完善产品布局。
AI 时代的 MySQL 数据库运维解决方案
文章指出大模型与MySQL数据库运维结合能改变传统管理方式,提供完整的MySQL大模型运维系统构建路径,涵盖知识库建设、模型选择与调用策略设计、MCP Server开发及监控与优化闭环建立,可提升运维效率与准确性。
刚刚,一口气连发3个王炸模型、亮出2026年AGI战略,昆仑万维夯爆了
27日下午,昆仑万维在2026中关村论坛发布全新AI游戏世界模型Matrix - Game 3.0、AI视频大模型SkyReels V4和AI音乐大模型Mureka V9,还公布2026 AGI战略,推动AI从全模态能力突破进入平台化构建阶段。
登顶SuperCLUE DeepSearch,openPangu-R-72B深度搜索能力跃升
近日 SuperCLUE 发布 11 月 DeepSearch 评测报告,国产大模型 openPangu - R - 72B 名列第一。它采用 MoE 架构平衡效率与性能,经预训练技术优化和 DeepSearch 专项突破,彰显国产算力与大模型研发融合成效。
西湖大学于开丞创业做概念世界模型,过亿元融资后首次公开发声
2023 年于开丞做世界模型无人看好,如今该领域大热。他曾否定自己成功工作,提出“概念世界模型”解决泛化问题。其创办的西湖数智已融资超 1 亿,还分享了技术路线及对行业的看法。
可攻可防,越狱成功率近90%!六大主流模型全中招 | EMNLP'25
研究人员聚焦大型语言模型(LLMs)安全漏洞,提出全新越狱攻击范式SCP与防御策略POSD。SCP基于DTD机制,在6个主流模型上平均攻击成功率达87.23%;POSD能有效抵御攻击,还提升模型泛化能力。
国产LLM大爆发的一周,Hugging Face热榜被承包了!
这一周国产开源LLM集中爆发,GLM - 4.5、Qwen3的5连发、Step3等接连发布。GLM - 4.5是新一代开源SOTA模型;Qwen3各版本在不同能力上提升显著;Step3是多模态推理模型;腾讯还发布了混元3D世界模型1.0。
抢先OpenAI?AIUI全新升级燃爆22亿终端,国内大厂定义智能交互
科大讯飞围绕智能交互场景,对AIUI、机器人超脑等4大平台全面升级。其AIUI以大模型为引擎,有儿童专属交互方案,还推出智能眼镜“三麦阵列”等,各平台在多领域应用成果显著。
SFT在帮倒忙?新研究:直接进行强化学习,模型多模态推理上限更高
学界常用「监督微调(SFT)+ 强化学习(RL)」训练大模型。但新研究发现,SFT 会引发「伪推理路径」,阻碍推理进步。相比之下,直接进行 RL 训练,模型多模态推理上限更高,该团队训练的模型还刷新了纪录。