CPU延时」共找到 82 篇相关文章

新闻资讯7

行业迎来大洗牌!4万 Agent 挤进一个机柜,AI Infra 要如何构建?

当 AI 从聊天机器人变为 Agent 后,AI 基础设施逻辑改变。浪潮信息副总经理赵帅判断,Agent 迫使 AI 基础设施重新分工,带来新的 CPU 计算需求。企业需关注资源分配、成本控制、系统重构等问题。

InfoQ
新闻资讯8

英伟达Vera Rubin首秀,DeepSeek V4 Pro 跑出30倍Agent吞吐

NVIDIA公布基于真实芯片的Vera Rubin性能测试结果,在针对Agent工作负载的测试中优势明显。SpaceXAI将部署其CPU,探索轨道计算。这显示未来AI竞争关键是支撑Agent的计算基础设施。

机器之心
开源动态8

Google这个1.5w star 项目牛皮,99%准确率!

Google安全团队开源AI文件类型检测工具Magika,抛弃固定规则匹配,用深度学习精准识别文件真实类型。它内置轻量模型,单CPU毫秒级推理,支持200+格式,准确率约99%,已大规模落地。

开源先锋
推荐文章7

面向 AI Agents 的高性能数据基座:架构和工程实践

在 QCon 全球软件开发大会上,晨章数据创始人陈亮分享了面向 AI Agents 的高性能数据基座。他指出 AI Agent 驱动的应用带来数据挑战,提出多模态数据基座设计目标,并介绍工程实践,证明传统架构有 CPU 瓶颈。

InfoQ
新闻资讯7

国产GPU芯动科技发布最新芯片,单卡直接堆上了112GB以上的超大显存

9月22日,芯动科技在珠海正式发布“风华3号”全功能GPU,它有诸多亮点,如集成国产RISC - V CPU与兼容CUDA的GPU、原生支持DICOM显示等,还构建了国产GPU完整生态。

AIGC开放社区
新闻资讯7

做路由器Wi-Fi芯片为什么那么难?

TP - Link芯片部门全员解散引发关注。做路由器Wi - Fi芯片技术难,要同时研发CPU主控和Wi - Fi芯片,且比端侧Wi - Fi芯片要求高。市场方面,不同地区市场各有挑战,创业需谨慎。

芯师爷
新闻资讯7

AMD:“拿捏”了英特尔,还要给英伟达“上强度”?

2025年第一季度财报显示,AMD营收74.4亿美元、净利润7.1亿美元,同比双升。客户端业务超预期,桌面级CPU份额反超英特尔;数据中心业务增长,GPU待新品发力。不过,MI308出口受限或影响业绩。

芯师爷
新闻资讯8

英伟达震撼首测Vera Rubin,DeepSeek吞吐暴涨30倍!

英伟达公布下一代旗舰级机柜Vera Rubin NVL72片上实测数据,用DeepSeek - V4 - Pro跑任务,每兆瓦吞吐量最高升30倍、Token成本最高降35倍。还宣布Groq 3 LPX量产,推出Agent专属Vera CPU,被SpaceXAI采用。

新智元
新闻资讯8

英伟达改卖Token?黄仁勋GTC后发声:token就是AI新通货,值钱的不是算力,是“每度电的智商”

英伟达黄仁勋在采访中强调其是加速计算公司,非单纯 GPU 公司。他认为 AI 竞赛从拼算力变拼产出,token 是新通货,还阐述了 AI 瓶颈、架构发展、推理编程、CPU 角色等观点。

AI前线
产品应用7

本地可运行的高质量的文本转语音模型

介绍Kyutai的Pocket TTS,一款轻量级文本转语音应用,可在CPU高效运行,模型小且低延迟,支持Python API和CLI,能语音克隆,还可在浏览器试用,目前仅支持英语,也有社区浏览器端实现。

GitHubStore