「Vera CPU」共找到 95 篇相关文章
最小模型仅 25MB,老设备无 GPU 也能流畅跑!
开源项目`KittenTTS`是文本转语音模型系列,核心特点是“小身材,大能量”。最小模型约1500万参数,体积25MB以内,无需GPU,靠CPU就能实现高质量语音合成,适合多种设备和场景。
行业迎来大洗牌!4万 Agent 挤进一个机柜,AI Infra 要如何构建?
当 AI 从聊天机器人变为 Agent 后,AI 基础设施逻辑改变。浪潮信息副总经理赵帅判断,Agent 迫使 AI 基础设施重新分工,带来新的 CPU 计算需求。企业需关注资源分配、成本控制、系统重构等问题。
Google这个1.5w star 项目牛皮,99%准确率!
Google安全团队开源AI文件类型检测工具Magika,抛弃固定规则匹配,用深度学习精准识别文件真实类型。它内置轻量模型,单CPU毫秒级推理,支持200+格式,准确率约99%,已大规模落地。
面向 AI Agents 的高性能数据基座:架构和工程实践
在 QCon 全球软件开发大会上,晨章数据创始人陈亮分享了面向 AI Agents 的高性能数据基座。他指出 AI Agent 驱动的应用带来数据挑战,提出多模态数据基座设计目标,并介绍工程实践,证明传统架构有 CPU 瓶颈。
黄仁勋 GTC 2026 演讲实录:所有SaaS公司都将消失;Token成本全球最低;“龙虾”创造了历史;Feynman 架构已在路上
北京时间 2026 年 3 月 17 日,英伟达 CEO 黄仁勋在 GTC 演讲,介绍一整套 AI“全家桶”。回顾 CUDA 20 年,提及数据处理新软件库,还展示 Vera Rubin 平台等,预测 SaaS 公司将消失,英伟达 2027 年营收或达万亿美元。
国产GPU芯动科技发布最新芯片,单卡直接堆上了112GB以上的超大显存
9月22日,芯动科技在珠海正式发布“风华3号”全功能GPU,它有诸多亮点,如集成国产RISC - V CPU与兼容CUDA的GPU、原生支持DICOM显示等,还构建了国产GPU完整生态。
黄仁勋 GTC 2026 演讲实录:所有SaaS公司都将消失;Token成本全球最低;“龙虾”创造了历史;Feynman 架构已在路上
北京时间2026年3月17日,英伟达CEO黄仁勋在GTC演讲,展示AI“全家桶”。他回溯CUDA 20年,介绍数据处理新软件库,还提及AI原生企业爆发、Token成本优势、Vera Rubin平台等,强调英伟达在AI领域的全面布局。
今夜无显卡!老黄引爆Rubin时代,6颗芯狂飙5倍算力
CES 2026上,英伟达黄仁勋发布Vera Rubin超算架构,推理性能比Blackwell提升5倍,训练性能提升3.5倍,成本降10倍,已投产,下半年商用。还展示自动驾驶模型等,且无新显卡发布。
做路由器Wi-Fi芯片为什么那么难?
TP - Link芯片部门全员解散引发关注。做路由器Wi - Fi芯片技术难,要同时研发CPU主控和Wi - Fi芯片,且比端侧Wi - Fi芯片要求高。市场方面,不同地区市场各有挑战,创业需谨慎。
AMD:“拿捏”了英特尔,还要给英伟达“上强度”?
2025年第一季度财报显示,AMD营收74.4亿美元、净利润7.1亿美元,同比双升。客户端业务超预期,桌面级CPU份额反超英特尔;数据中心业务增长,GPU待新品发力。不过,MI308出口受限或影响业绩。