上纬新材」共找到 5119 篇相关文章

算法论文8

ICML 2025 Spotlight|华为诺亚提出端侧大模型架构MoLE,内存搬运代价降低1000倍

华为诺亚和北大研究人员提出端侧大模型架构MoLE。它解决传统MoE显存开销大、传输延迟高问题,推理时将专家输入改embedding token,用查找表替代矩阵运算,实验显示性能与MoE相当,大幅降推理延迟。

机器之心
推荐文章7

基于一个MXFP8量化Kernel谈一谈如何在B200实现高性能的Memory Bound Kernel

作者向SGLang社区提交基于CUTLASS的MXFP8 Blockscaled Grouped GEMM实现,其中包含量化Kernel。文章关注此Kernel,介绍在B200实现高性能Memory Bound Kernel的优化技术,如整体设计、向量化与合并访问、Occupancy优化、TMA利用等。

GiantPandaLLM
算法论文8

融资 1200亿后 Kimi 再扔王牌,架构爆改 Transformer 老配件,比 DeepSeek 同款还省钱

Kimi 发布论文,提出“注意力残差”架构改进 Transformer 残差连接,解决“稀释问题”,让 AI 更聪明、更省钱,还推出“分块注意力残差”优化成本。与 DeepSeek 方案对比,Kimi 方案性价比更高。

AI前线
算法论文8

突破Pass@1瓶颈:一种让LLM自我博弈、永不枯竭的RL范式,超越基线22.8%!

近年来,基于可验证奖励的强化学习(RLVR)在提升大型语言模型(LLM)推理能力有关键作用,但存在熵崩溃问题。论文提出SVS创策略,让模型自我合成变分问题形成自我提升循环,实验效果惊人。

深度学习自然语言处理
新闻资讯8

谷歌发布最强 AI“全家桶”、一句话就让AI拍大片!这一夜,谷歌Gemini贯穿始终,网友:果然Android“靠边站”了

谷歌在I/O大会推出AI“全家桶”,含Gemini 2.5模型更、搜索AI模式等。谷歌已发布十多个模型、20多个重大AI产品与功能,多项数据显示AI发展迅速,还有多项目融入产品,多模态模型升级。

AI科技大本营
产品应用7

高考数学全卷重赛!一道题难倒所有大模型,选手Gemini夺冠,豆包DeepSeek并列第二

因网友质疑次测评不严谨,此次用六款大模型挑战含解答题的全套高考数学题。结果Gemini 2.5 Pro夺冠,Doubao和DeepSeek R1并列第二。解答题是失分重灾区,图像题难倒多模态大模型。

机器之心
算法论文8

揭秘LLM“思考”之谜:推理即“梯度下降”,元学习框架解构训练过程,还给优化提供思路

海AI Lab团队提出RaML框架,从梯度下降和元学习角度揭示LLM“思考”机制。通过实证验证推理轨迹作为参数更的合理性,还对比不同训练策略,指出RaML为优化LLM性能提供思路。

量子位
开源动态8

1.7K star!找到啦,小众需求,但是需求的时候你一定用得,企业级能源管理神器

MyEMS是开源能源管理系统标杆,基于Python+Django构建,提供完整解决方案。支持多场景能耗监控,通过可视化报表和AI算法优化能效,助企业降15%-30%能源成本,还介绍了其功能、架构等。

小华同学ai
开源动态8

AI4S设计的抗生素通过湿实验!双层思考+多目标优化,主动发现「代谢不稳」并加约束

SAGA是AI,采用双层思考机制,能主动审视需求、优化目标函数。在抗生素、纳米抗体等5大领域湿实验中表现出色,结果获科学家肯定,相关代码已开源。

量子位
算法论文8

AI for Science开年突破:中科大实现多尺度结构逆向设计128倍加速,登Nature子刊

中国科学技术大学联合多所院校,在多功能双连通多尺度结构逆向设计领域取得突破,成果发表于Nature Communications。研究解决核心瓶颈,提供范式,在多方面展现优势与潜力。

机器之心