高性能全闪存储」共找到 3432 篇相关文章

算法论文8

ICLR 2026 | ProSafePrune:一剪见效,告别大模型过度防御

合肥工业大学与科大讯飞联合团队提出全新低秩参数修剪框架 ProSafePrune,被 ICLR 2026 录用。它能精准定位模型认知偏差并修剪,降低过度拒绝率,不损安全防御能力,还提升通用任务性能,为 LLM 安全部署提供新思路。

机器之心
开源动态7

OpenAI解密大模型失控:它不是变坏,而是「太听话」

OpenAI公开IH - Challenge,解决大模型指令冲突难题。指出大模型问题多因听信错误指令,给出系统>开发者>用户>工具的指令层级结构,设计数据集训练模型遵循信任等级指令,提升安全可控性与抵御提示词注入能力。

新智元
算法论文8

超越MLA!新架构MLRA百万token,解码最2.8倍速 | ICLR'26

大语言模型处理长文本时,自回归生成受限于显存带宽。为减少KV缓存开销,业界尝试多种方法,但MLA有缺陷。宾夕法尼亚州立大学等研究人员提出MLRA,拆分KV缓存为四个并行分支,降低显存占用,实现4路张量并行,性能更优。

新智元
算法论文7

R1/Qwen训练新范式:无需继续训练,直接“算”出权重,提效500%

DeepSeek - R1爆火让RLVR成大模型后训练焦点,但训练代价昂。学者发现RLVR中LLM权重和输出概率呈线性变化,提出“权重外推”等方法,实现最6.1倍训练加速,RL - Extra在多榜单展现效率。

PaperAgent
新闻资讯7

SK 海力士,市值突破4000亿美元

1月27日,SK海力士股价创新,市值达4031亿美元,三年涨10倍。因AI基建投资扩张,内存芯片供应紧缺。传其为微软供芯,韩媒称它和三星提LPDDR内存价,或影响iPhone 18价,还将发额奖金。

芯师爷
开源动态8

8B模型任务击败GPT-5?阶跃星辰开源Deep Think新框架,小模型解锁百万Token测试时计算

阶跃星辰推出并行协同推理框架PaCoRe,让大模型突破上下文窗口和处理速度限制。基于此框架,小模型能解锁百万级Token测试时计算。PaCoRe - 8B在数学基准测试中超越GPT - 5,还具备前沿性能、“综合”能力涌现等优势。

机器之心
新闻资讯8

黄仁勋手撕「AI泡沫」论!英伟达570亿铁拳暴击,显卡全断货

英伟达Q3 2026财报显示单季度营收达570亿美元,数据中心业务同比狂涨66%。黄仁勋称AI不是泡沫,而是计算范式从通用CPU转向加速式GPU计算的必然。当前多数AI公司估值、收入低,英伟达作为‘卖铲人’大获全胜。

新智元
新闻资讯7

国产GPU双雄竞速,大佬葛卫东再赴资本盛宴

“国产GPU第一股”争夺正酣,继摩尔线程后,沐曦股份科创板IPO过会,估值达210亿。其创始人陈维良背景深厚,产品量产快。私募大佬葛卫东多次下注,收益接近翻倍。但国产GPU研发风险,谁能抢占先机待察。

芯师爷
开源动态8

斯坦福&SambaNova联手发布ACE框架:上下文即战力

文章介绍了斯坦福与SambaNova联手发布的ACE框架。它解决传统提示工程缺陷,将提示工程升级为智能体自我演化体系。通过“生成 - 反思 - 策展”闭环,实现上下文低成本、低延迟、扩展演化,小模型搭配它能击败大模型+传统提示。

CourseAI
8

“智元机器人收购A股上市公司是创新需要…现金流能撑三年”

智元机器人收购A股上纬新材后公开亮相,董事长邓泰华透露融资、出货等规划。其团队管回应收购舆论、技术成果及合作等问题,如远征A2温行走突破、与上市公司合作原因等,还提及出海和工业场景ROI规划。

量子位