显著性方法」共找到 1246 篇相关文章

开源动态8

华为开源突破技术Flex:ai,AI算力效率直升30%,GPU、NPU一起用

11月21日,华为发布AI容器技术Flex:ai并联合高校将其开源。该技术基于Kubernetes构建,有三大核心突破,能提升算力利用率,异构兼容优于Run:ai,将推动国产算力应用。

机器之心
新闻资讯7

GPT-5七月上线?内部爆料+奥特曼疯狂暗示,自曝前时刻「令人恐惧」

近日,多消息显示OpenAI可能7月发布GPT - 5,奥特曼也确认o3 pro快来了。人们对GPT - 5期待颇高,猜测其能力有提升也有局限。奥特曼访谈透露AI会带来多面变化,应服务个人意志。

新智元
算法论文7

LLM加RL遭质疑:故意用错奖励,数学基准也显著提升,AI圈炸了

华盛顿大学等机构论文引爆AI界,其发现用虚假奖励训练Qwen2.5-Math-7B模型,也能提高MATH - 500成绩。虚假奖励对Qwen模型有效,但在其他模型上有限,凸显RLVR有效与模型能力有关。

机器之心
新闻资讯8

英伟达官推理指南来了!6倍无损加速,最优解全是华人写的

9月2日,英伟达技术博客上线《用投机解码做AI模型协同设计》,给出推理加速选型表。列入指南的核心案多由华人团队主导,介绍了从外置草稿模型到n - gram查表法等案,还提到硬件常数对模型架构的约束。

新智元
算法论文8

泛化暴涨47%!首个意图检测奖励范式,AI工具爆炸时代意图识别新解法

随着大模型和工具增长,AI 助手意图识别遇新挑战。腾讯 PCG 团队用强化学习等法,提升模型泛化能力,还从多面剖析优势,最后提出未来研究向。

机器之心
新闻资讯7

刚刚,OpenAI公司结构重大调整:继续由非营利实体控制,营利部门要变公益公司

OpenAI官宣布公司结构重大调整,将继续由非营利组织控制,现有营利部门成公益公司(PBC),非营利组织控制PBC并成大股东,二者使命相同。这是与相关部门对话后决定。

量子位
算法论文8

8B模型可以超过GPT-4o!并行KV Cache压缩支持的128K长度外推法ParallelComp

大模型长文本推理存在瓶颈,作者提出 ParallelComp 案。它有并行 Attention 分块、KV 缓存智能淘汰与注意力偏差校准三大创新,能让 8B 模型能达 GPT - 4o 的 91.17%,特定任务超 GPT - 4o。

机器之心
算法论文8

别再只关注KV Cache了! LLM稀疏新洞察:为何模型越深越稀疏?UNCOMP从矩阵熵给出答案

团队论文UNCOMP获EMNLP 2025主会接收,它提出高效推理框架,从截断矩阵熵视角解释LLM深层稀疏现象。还能识别关键结构、找到最优压缩策略,设计的UNCOMP框架优化KV Cache,实验效果佳。

深度学习自然语言处理
开源动态8

只训练数学,却在物理化学生物战胜o1!新强化学习算法带来显著能提升,还缓解训练崩溃问题

上海创智学院、上海AI Lab的MM - Eureka系列工作提出新强化学习算法CPGD,缓解训练崩溃问题,提升能。还构建多模态强化学习框架,推出MMK12数据集和MM - PRM模型,开源相关成果。

量子位
开源动态8

阿里通义开源「推理+搜索」预训练新框架:小模型媲美大模型,多个开放域问答数据集表现显著提升

阿里通义实验室开源通用预训练框架MaskSearch,引入检索增强型掩码预测任务,兼容两种训练法。实验显示,它在多数据集提升模型能,小模型能媲美大模型,还验证了训练式、策略及奖励函数的效果。

量子位