算力提升」共找到 3582 篇相关文章

新闻资讯7

澜起科技:高速互连芯片巨头历史

文章讲述澜起科技发展历程。它从电视机顶盒芯片转型内存接口、高速互连芯片,虽历经政策冲击、做空危机、供应链压力与客户竞争等挑战,但凭借技术实力和研发投入,在行业中站稳脚跟,未来有望受益于AI算力需求升级。

芯师爷
算法论文8

英伟达揭示RL Scaling魔力!训练步数翻倍=推理能力质变,小模型突破推理极限

学界对强化学习能否让模型学会新推理技能争论已久,过去研究多悲观。英伟达研究指出,问题源于任务在基础模型训练数据中过度呈现及训练步数不足。其ProRL框架提升训练步数,释放小模型潜力,还构建技术组合拳。

机器之心
新闻资讯8

突发,OpenAI首颗「辣椒」芯片压倒英伟达!GPT-6干崩CUDA

OpenAI首颗自研芯片Jalapeño「墨西哥辣椒」实测成绩亮眼,AI推理性能超英伟达全系,功耗仅为一半。它从设计到流片仅用九个月,得益于GPT - Astra协助。有观点认为CUDA护城河或已死,OpenAI正打造算力版图。

新智元
算法论文8

SAPO:让强化学习告别“硬剪切”

强化学习是提升大语言模型推理能力的核心技术之一,但现有基于组的策略优化方法面临 token 级重要性比率高方差问题。GRPO 和 GSPO 采用硬剪切有学习信号丢失等缺点。为此提出 SAPO,用平滑门控函数替代硬剪切,实验效果良好。

通义千问Qwen
7

【博客转载】CUDA Vectorized Memory Access (文末送书)

文章展示如何用向量化内存访问提高CUDA函数有效内存带宽,实现朴素自定义设备内存拷贝函数,对比不同数据类型、大小及方法的性能,得出拷贝数据单元多、单元大及以8或16字节向量化单元拷贝可提升带宽等结论。

GiantPandaLLM
推荐文章8

后AlphaFold时代的冷思考,AI制药的破与立 | GAIR live 028

雷峰网等组织“后AlphaFold时代AI制药的破与立”线上圆桌,三位学者探讨AI制药问题。指出算力难颠覆生命法则,数据有缺陷,还给出赛道选择建议,提及AI Agent重塑科研关系及中国AI制药优势与挑战。

AI科技评论
产品应用8

文心X1.1三大能力狂飙,海内外实测还挺惊艳!

9日WAVE SUMMIT深度学习开发者2025大会上,文心大模型X1.1发布,事实性、指令遵循、智能体能力显著提升,多项测试表现佳。它能做到知识一致,精准遵循指令,智能体解决问题出色,代码、数学、多模态能力也有进化,得益于迭代式混合强化学习训练框架。

新智元
开源动态8

纯血国产!4B模型越级打怪,杀入万亿赛道

9月1日,Hugging Face上线星火X2.5-4B和1.7B开源端侧模型,在多指标测试中表现优异,实现“越级打怪”。该模型基于全国产算力平台训练,在断网笔记本上实测效果惊艳,使用了两项技术提升能力,适配性强。

新智元
产品应用8

有生之年吃到了钉钉的细糠

作者参加“2025 钉钉十周年暨新品发布会”,体验了钉钉 8.0 版本。该版本开启 AI 1.0 新篇章,界面焕然一新,以钉钉 One、AI 搜问等重塑工作流程,还升级语音智能硬件,实现信息处理闭环,提升企业与员工效率。

MacTalk
新闻资讯8

Anthropic刚发布了一份「AI抢饭碗报告」:学历越高越「被抢」

Anthropic《经济指数报告》揭示,任务越复杂AI加速越猛,学历高的工作受影响大。还指出人机协作能大幅提升任务时长,不同国家AI应用有贫富和技术代差,也提到了‘去技能化’问题及对生产率的预测。

新智元