「芯片定位」共找到 920 篇相关文章
内存减6倍、精度0损失,推理提速8倍!谷歌新技术震撼了AI圈
Google Research团队推出TurboQuant技术,能将KV缓存6倍压缩、无精度损失,推理速度提升8倍,解决内存瓶颈问题,为大语言模型应用扫清障碍,引发业界关注,还致存储芯片巨头股价大跌。
独家对话Sharpa核心团队:如何把人类的“触觉”装进机器人的身体|甲子光年
甲子光年对话Sharpa核心团队,该团队定位是以触觉AI驱动的全栈灵巧机器人公司。团队认为触觉是机器人灵巧操作关键,介绍CraftNet创新,还提及与英伟达合作及公司运营、商业计划等。
2027年至少营收1万亿美元!龙虾就是新操作系统丨黄仁勋GTC万字实录
2026年3月16日英伟达GTC大会上,黄仁勋阐述英伟达从芯片公司向AI基础设施和工厂公司的蜕变,给出强劲业绩预期,介绍“Token工厂经济学”,还展示新系统、技术,提及AI软件和生态革命等。
AI 驱动的大数据自治:TCInsight 智能应对复杂运维挑战
在大数据平台高速发展下,传统专家运维模式难应对复杂问题。腾讯专家工程师熊训德介绍大数据智能管家 TCInsight,其架构分三层,结合规则与专家系统提升自治能力,还分享实践案例,指出后续待优化方向。
Claude Cowork刚发布,就有大佬开源复刻了!支持三方 API,让 AI 帮你干活!
2025年AI关键词是Agent。Claude推出新功能Cowork,定位是‘大众版Claude Code’,但官方版贵且封闭。发布不到24小时,GitHub就有大佬开源复刻版Claude - Cowork,它支持三方API,本文深度剖析其功能与特点。
黄仁勋CES放出大杀器:下一代Rubin架构推理成本降10倍
在CES 2026展上,英伟达黄仁勋介绍多项进展。下一代Rubin平台含六款芯片,推理成本降10倍;发布Alpamayo 1开源模型助力自动驾驶;还推出物理AI新模型等,携手伙伴展示机器人。
罗福莉携小米MiMo-V2-Flash首次亮相:一次在推理与Agent上的下注|甲子光年
大模型进入新阶段,效率成能力一部分。小米MiMo团队12月16日晚发布并开源MiMo - V2 - Flash,负责人罗福莉首亮相。该模型在推理、编程和智能体场景表现出色,在架构、训练方法等有创新。
AI Agent 落地之困:为什么“人”与“流程”是最大障碍?
本文解读 MMC 报告,揭示 AI Agent 落地面临核心挑战、衡量标准、付费模式及落地策略。指出最大障碍是‘人’与‘流程’问题,如工作流集成、员工抵触、数据隐私等,还提及企业付费情况和成功落地秘籍。
叫板英伟达RTX 5090!GPU初创公司做出13倍路径追踪性能的怪兽显卡
芯片初创公司Bolt Graphics首款GPU模组Zeus 4C,路径追踪性能达RTX 5090的13倍。但它不适合游戏场景,更擅长低功耗高精度图形渲染,不过测试、应用、价格目前都是未知数。
砺算科技GPU背后的故事
文章讲述砺算科技GPU背后故事,包括其团队核心成员来源,经历的资金、欠薪等问题,还提及S3人员流动衍生出的其他GPU企业。分析砺算科技团队稀缺性、融资短板等情况,对比不同GPU发展路线。