B200 GPU」共找到 1277 篇相关文章

产品应用8

GPU 成为主角:解锁 AI 集群中那 85% 的闲置 CPU 算力

全球AI算力规模增长,GPU成主角,但GPU满负荷运转时CPU利用率低,传统调度机制无法保障优先级,造成资源浪费。TencentOS如意(RUE)的在离线混部技术改造Linux内核调度体系,高效释放算力。

InfoQ
产品应用8

不上云、不租卡,如何优雅地在本地微调Qwen-VL-30B

文章指出企业训练多模态助手,30B 参数的开源多模态模型如 Qwen-VL-30B 是不错选择,但多模态场景下显存需求大。联想 ThinkStation PGX 解决了显存难题,还介绍其性能、优势、适用场景及服务等。

机器之心
新闻资讯7

5Y News | 地瓜机器人完成1.5亿美元B2轮融资

近日,地瓜机器人完成1.5亿美元B2轮融资,B轮累计2.7亿美元。2025年业务成果出色,出货量增180%、客户量翻倍、开发者破10万。它与地平线打造具身智能大脑基座,释放多场景应用潜力。

五源资本 5Y Capital
推荐文章7

“被投资人怒怼30分钟后,我更确定中国To B的答案” | 甲子光年

文章讲述百融云创在AI To B领域的探索。它突破传统“卖工具”模式,采用“结果计价”,共担结果、承包KPI。技术上提前押注语音对话技术栈,“硅基员工”概念落地多场景,有望推动中国To B行业进入新秩序。

甲子光年
新闻资讯7

AI Infra 正在诞生自己的石油期货?GPU 不够买之后,华尔街开始交易算力

AI 行业焦点从 GPU 够不够用转向算力定价。2026 年 8 月 CFTC 就算力衍生品公开征求意见,CME 与 Silicon Data 计划推期货产品。但 GPU 算力金融化面临标准化、衡量方式等难题。

InfoQ
推荐文章7

对话蚂蚁吴伟:训推一体池化调度,如何把GPU用到极限

AICon大会前,与蚂蚁集团吴伟深度对话,探讨GPU资源调度解法。他指出CPU和GPU有结构性差异,只在推理或训练内优化有资源闲置,国产卡缺全链路生态,软件优化有天花板。还分享架构思路、算法及落地效果等。

InfoQ
开源动态8

14B规模竟也能单卡实时生成视频?多亏这个强大的开源底座

春节期间 Seedance 2.0 爆火,字节跳动等开源视频模型 Helios 家族,参数量 14B,单卡生成速度达 19.5 FPS。它与 UniWorld-OSP2.0 技术栈同源,后者是超百亿级视频生成大模型,有诸多技术突破。

机器之心
开源动态7

Qwen3.8-27B 登顶全球开源榜第一,曾经的「源神」又回来了!

8月17日,阿里发布的Qwen3.8 - 27B成Hugging Face热门第一。它以27B参数在部分测试中与前沿闭源模型比肩,可本地运行。不过推理慢、真实任务表现待提升,它让前沿Agent能力下放到个人电脑。

AI科技评论
开源动态8

里程碑时刻!首个100B扩散语言模型来了,技术报告揭秘背后细节

蚂蚁集团与高校联合团队推出 LLaDA2.0 系列扩散语言模型,其中 LLaDA2.0 - flash 参数量达 100B。技术报告披露细节,其解决了 dLLM 做大做强难题,性能比肩 AR 模型,为扩散模型工业化带来转机。

机器之心
产品应用8

豆包背后的“超算大脑”:字节ByteRobust系统跑20多万张GPU,性能刷新SOTA

字节跳动自研的ByteRobust系统登上SOSP 2025,部署于超20万张GPU平台,9600张GPU训练三个月ETTR达97%。该系统应对LLM训练故障,由控制和数据平面构成,能自动发现修复故障,提升训练效率与稳定性。

AIGC开放社区