算法论文8
ProSafePrune:告别大模型过度防御
机器之心
AI 摘要
合肥工业大学与科大讯飞团队:提出 ProSafePrune 框架,揭示大模型过度拒绝根源是‘过度有害编码’,通过子空间投影与低秩修剪,实现安全、实用双提升,为 LLM 安全对齐提供新范式。
阅读原文 · 机器之心
ICLR 2026 | ProSafePrune:一剪见效,告别大模型过度防御
合肥工业大学与科大讯飞联合团队提出全新低秩参数修剪框架 ProSafePrune,被 ICLR 2026 录用。它能精准定位模型认知偏差并修剪,降低过度拒绝率,不损安全防御能力,还提升通用任务性能,为 LLM 安全部署提供新思路。

关注公众号
扫码关注
第一时间收到每日精选
相关文章
新闻资讯8
DeepSeek高毛利,冲刺5000亿估值A股上市
据外媒报道,DeepSeek今年前七个月营收约4.75亿,较2025年全年增长近10倍,净亏损收窄,综合毛利率44.6%,API业务毛利率达82.9%。它正磋商500亿二轮融资,筹备明年沪上市,靠优化基建降本,低价策略吸客。
AI前线
产品应用7
Google发布“法律版Gemini”进军法律界
8月25日,Google Cloud发布Gemini Enterprise for Legal面向律所和企业法务团队开放预览。它想解决让模型进入律所现有工作系统,不打乱权限等规则的问题,通过MCP连接系统并继承权限,还组织各方合作。
AIGC开放社区
算法论文8
NovaSilicon:造芯瓶颈在组织而非工具
NovaSilicon发表论文探讨超级智能在芯片领域的运用。随着芯片复杂度提升,传统EDA方法遇瓶颈,论文提出将芯片设计超级智能建模为AI组织,利用LLM等技术,重塑芯片设计行业,实现产业链智能化升级。
五源资本 5Y Capital
新闻资讯8
OpenAI自研芯片「墨西哥辣椒」跑赢英伟达
OpenAI公布自研推理芯片Jalapeño(墨西哥辣椒)测试结果,它专为大语言模型推理设计,能同时提升吞吐量和降低延迟,在多模型测试中超NVIDIA系统。该芯片与Cerebras合作,计划2026年底部署。
机器之心