训练推理加速」共找到 4000 篇相关文章

产品应用8

MiniCPM 4.0极速狂飙,端侧模型的比赛,结束了!

面壁智能联合清华发布MiniCPM 4.0,极限场景220倍加速。它是首个原生稀疏模型,有InfLLM v2、CPM.cu等创新,基准测试碾压对手,适配全平台,还有科研、工具调用等功能,标志端侧长文本时代到来。

AGI Hunt
新闻资讯7

180亿深圳芯片黑马,华为猛下单

4月25日晚,云天励飞公告2024年营收超9亿,同比增81.3%,截至4月28日收盘市值超180亿。该公司以‘算法芯片化’为基础,在推理算力、行业赋能、消费级业务均有布局,还与华为等合作。

芯师爷
推荐文章7

智谱公布“降智”的秘密:Scaling不可避免的痛

智谱最新技术博客大倒苦水,称从GLM - 5以来遭遇「Scaling Pain」。团队排查出高负载下推理状态管理等问题致异常,还给出避坑指南,如在线异常监控策略,优化后系统更稳定,吞吐量提升。

量子位
开源动态8

击败 GPT-5!理想汽车开源 RubricHub:大模型开放生成从此有了专业裁判

理想汽车基座模型团队联合高校发布RubricHub数据集,解决开放式任务评价难题。该数据集可将主观评价转化为量化标准,经其训练的Qwen3 - 14B小模型在医疗基准测试中超越GPT - 5。

AI科技评论
新闻资讯8

马斯克xAI又融了200亿美元!老黄说到做到投了更多

刚开年,马斯克的xAI完成E轮融资,达200亿美元超预期。英伟达和思科等继续支持,其估值预计从500亿涨至2000多亿。还公布《xAI 2025年终总结》,Grok 5正在训练,传闻一季度推出。

量子位
新闻资讯8

医生版 ChatGPT 3 年估值 60 亿美金,被低估的 AI 硬件新玩法:相框

OpenEvidence被称为医学领域的Google和医生版ChatGPT,成立3年估值达60亿美金。它用高质量数据训练小而专模型,有“无幻觉”机制,直接面向医生推广,产品进化为临床决策助手,收入来自制药广告。

投资实习所
算法论文8

ICCV 2025 | SeaS: 工业异常生成+正常合成+精准掩码大一统框架,指标全面碾压SOTA

华中科技大学慢工团队提出少样本工业生成模型SeaS,依托U-Net,只需1 - 3张训练样本,单模型同步实现多样异常生成、正常产品合成及精确异常掩码标注,突破现有方法局限,在主流数据集上超越SOTA。

机器之心
开源动态8

手机也能跑,腾讯混元一口气开源4款小模型

腾讯混元团队开源4款小模型,最大7B。可在低功耗场景运行,支持微调。是融合推理模型,有快、慢思考模式,在多领域表现出色,亮点是agent和长文能力,已落地多元业务场景。

机器之心
推荐文章7

为什么我觉得AGI并不会马上到来

作者Dwarkesh Patel认为AGI不会马上到来。当前大语言模型缺乏持续学习能力,难以替代人类工作;计算机操作能力受训练周期、数据等限制;推理能力虽有突破,但仍需时间发展。作者给出了具体预测时间。

宝玉AI
推荐文章7

代码怎么才能跑的更快

文章围绕让代码跑更快展开,先介绍调整源代码的方法,如降低循环开销、去除内存引用等,又阐述使用硬件加速指令,像用 SIMD 函数、避免分支语句等,还提及多核并行和分析瓶颈等要点。

阿里云开发者