量化原理」共找到 413 篇相关文章

算法论文7

MoE RL 实战:统一 FP8 全流程训练

SGLang RL 团队等实现 RL 全流程 FP8 训练与采样,消除训推不一致性。介绍 FP8 硬件基础、格式等,分析训练难点,定位 KL Loss 异常源于量化原理,验证其在 MoE 模型 RL 场景优势,指出模型规模与训推不一致的关联。

GiantPandaLLM
新闻资讯8

对话八位具身智能大咖:模型之争、数据来源与第一性原理|甲子光年

在11月20日智源具身OpenDay上,甲子光年创始人张一甲与八位具身智能领域核心践行者对话。探讨世界模型、统一架构等问题,指出具身智能虽前景好,但面临数据、模型等困境,各方分享应对策略与决策原则。

甲子光年
开源动态8

AI 本地跑?Google 新开源模型上线,本地量化后占用不到 200MB 内存,支持百余语言

Google DeepMind推出开源嵌入模型EmbeddingGemma,专为本地设备高效运行设计。它用Matryoshka方法和量化感知训练,提升效率。在MTEB测试中成绩佳,支持百余种语言,内存占用少,已集成多种工具。

InfoQ
新闻资讯8

账号与身份防线全面失守:黑灰产 Agent 化攻击下,如何用“第一性原理”重建防线?

11月13日,Anthropic报告称黑客利用AI Agent化能力达新高度,攻击模式转变使传统风控防线失效。数美科技CTO梁堃指出防御要下沉至‘第一性原理’,详解‘反欺诈三定律’,还提出‘不确定性标签’等方案。

AI前线
算法论文8

北航团队提出新的离线分层扩散框架:基于结构信息原理,实现稳定离线策略学习|NeurIPS 2025

北航彭浩团队提出SIHD框架,基于结构信息原理,自适应构建多尺度扩散层级,实现稳定离线策略学习。通过构建状态拓扑图、用结构信息增益引导扩散、引入结构熵正则化器,在D4RL测试中表现出色。

AI前线
7

【博客转载】CUDA Vectorized Memory Access (文末送书)

文章展示如何用向量化内存访问提高CUDA函数有效内存带宽,实现朴素自定义设备内存拷贝函数,对比不同数据类型、大小及方法的性能,得出拷贝数据单元多、单元大及以8或16字节向量化单元拷贝可提升带宽等结论。

GiantPandaLLM
推荐文章7

AI 基础知识从-1到0.1:带你走进机器学习的世界

文章沿着AI发展脉络,从Seq2Seq到GPT模型,深入介绍关键技术原理。以简明方式梳理AI基础概念,涵盖人工智能、机器学习等定义,还介绍了各类学习方法、特征工程及向量化等内容,最后提及模型应用流程和Quick BI助力企业分析。

阿里云开发者
新闻资讯7

DeepSeek刚提到FP8,英伟达就把FP4精度推向预训练,更快、更便宜

DeepSeek提及针对国产芯片的FP8量化设计,引发对大模型量化策略关注。不久后英伟达发力低精度量化,将NVFP4策略拓展到预训练阶段,其方案能解决核心挑战,实验证明NVFP4在大规模训练中可行。

机器之心
算法论文8

挑战 1 比特!ETH Zürich 秦浩桐:如何把大模型「塞进」小设备?| IJCAI 2026

IJCAI 2026大会上,秦浩桐给出创新解法,挑战无需重训的“后训练量化”极限,将庞大的LLM强行压缩至极端的1比特与2比特。其团队的BiLLM与SqueezeLLM打破了后训练量化魔咒,还指出极低比特量化的三大挑战。

AI科技评论
新闻资讯8

9位顶级研究员连讲3晚,华为盘古大模型底层研究大揭秘

华为诺亚方舟实验室成果颇丰,4月开发千亿级通用语言大模型Pangu Ultra,5月推出稀疏大语言模型Pangu Ultra MoE。5月28 - 30日,机器之心联合举办分享会,9位研究员揭秘量化、剪枝等关键技术突破。

机器之心