「软件优化」共找到 1796 篇相关文章

产品应用8

PCIe显卡被低估了!内核补齐+通信重构,DeepSeek推理吞吐直接翻近7倍

当前大模型算力需求攀升,高端GPU供给紧成本高,大量PCIe长尾GPU算力因框架适配不足被禁锢。是石科技自研Meta-Infer推理引擎,通过纯软件优化挖掘硬件潜力,让DeepSeek推理吞吐提升近7倍,方法也适配国产GPU。

量子位
产品应用8

微信自研高性能推理计算引擎 XNet-DNN:跨平台 GPU 部署大语言模型及优化实践

本文深入解析微信自研的高性能推理计算引擎 XNet-DNN,介绍其核心技术架构和性能优化策略。该引擎基于 RCI 框架构建跨平台 GPU LLM 推理能力,在多方面超越现有解决方案,还给出了详实对比实验数据。

腾讯技术工程
开源动态8

第二代PPTAgent来了!中科院软件所开源首个本地通用幻灯片智能体,9B参数打平GPT-5

中科院软件所开源第二代PPTAgent -- DeepPresenter,将幻灯片智能体模型与智能体沙箱环境一同开源。它解决了AI制作PPT的痛点,以9B参数打平GPT - 5,在消费级显卡上有出色表现。

机器之心
新闻资讯7

“软件比白领更先被 AI 击穿”!Anthropic CEO 最新改口,反讽马斯克危言耸听,两大佬隔空互掐

Anthropic获300亿美元G轮融资,马斯克怒怼其AI有“厌世、反人类倾向”。Anthropic CEO Dario Amodei暗讽马斯克“危言耸听”,改口称软件比白领更易被AI击穿,还探讨了AI在医疗、经济、民主等方面的影响及风险。

InfoQ
新闻资讯7

“软件比白领更先被 AI 击穿”!Anthropic CEO 最新改口,反讽马斯克危言耸听,两大佬隔空互掐

Anthropic获300亿美元G轮融资,马斯克怒怼其AI“厌世、反人类”。Anthropic CEO Dario Amodei暗讽马斯克说法“危言耸听”,还改口称软件比白领更易被AI击穿。此外他还谈了AI在多领域的影响及风险应对。

AI前线
推荐文章7

当你感到AI编程无所不能时,也许正站在“愚昧之巅”——理性看待AI时代的软件开发与应用变革

文章分析AI时代软件开发、产品设计和内容营销的变化。赞同产品设计半开放式、加速MVP效率等;部分赞同VOC捕捉、SEO自动化等,但有待验证;不认同普通开发者被淘汰等过于乐观的预测。指出多数变化5年渐显。

宝玉AI
算法论文8

国产芯片比英伟达整体效率更高!?华为 CloudMatrix384 超节点首曝论文,跑 DeepSeek 效率超越英伟达

今年4月,网上曾争论华为芯片效率是否超国际主流。近日华为团队论文公开,阐述在CloudMatrix 384超节点部署DeepSeek大模型细节,性能指标超英伟达体系,还介绍架构、软件栈及适配优化方案。

InfoQ
新闻资讯8

用 Astra+Codex 干掉 CUDA!奥特曼9个月AI造芯反杀英伟达 GB300

北京时间昨日凌晨,OpenAI 公布自研推理芯片 Jalapeño 实测结果,其在多指标挑落英伟达 GB300。OpenAI 用 GPT - 6 和加强版 Codex 造芯,9 个月完成硬件设计优化,3 个月搞定软件栈,威胁英伟达 CUDA 根基。

AI前线
开源动态7

AMD跑GLM 5.2,成本只要英伟达一半

推理优化公司Wafer公布数据,用AMD的MI355X芯片跑GLM 5.2,单节点吞吐达2626 tok/s,单流吞吐213 tok/s,成本不到英伟达B200的一半。该公司详述部署过程,还提及AMD软件生态的变化及英伟达面临的挑战。

量子位
推荐文章8

AI可以用任何手段、写任何东西,但你得是个“中年老登”

PingCAP 黄东旭称做 db9 项目未看到 AI 边界,语言、框架、数据库选型不再长期锁定,AI 能写任何软件。徐昊认为软件知识比代码重要,‘重写’概念或过渡。滕昱指出 AI 需‘老登’掌舵,企业软件维护仍存难题。

InfoQ