「算力引擎」共找到 1097 篇相关文章
Claude一天3崩!API、App、Cowork全挂,打工人集体抓瞎
8月24日Claude一天崩三次,Anthropic状态页三次变红又宣布恢复,但用户仍打不开。故障从中午持续到下午,波及多个产品。8月故障频发,还存在算力枯竭、模型变笨等问题。
金属探伤微小缺陷:YOLOv11 改进,漏检率从 54% 降低到 19%
工厂质检工作累且易出错,用摄像头加AI检测,需模型在复杂车间环境识别微小缺陷。论文对YOLOv11改进,插入三个即插即用模块,降低漏检率、提升精度,还做了公平实验,公开数据。
AI Infra进阶:如何让大模型输出确定的结果
文章探讨大模型输出确定性结果的问题。指推理引擎底层动态组批与算子调度策略,因浮点加法顺序变化使结果波动。还分析GEMM、RMSNorm等算子影响,给出vLLM实现Batch Invariance的方法。
Nanbeige4.2-3B:探索通用Agent小模型
在模型越做越大的当下,推理成本成了影响Agent大规模使用的关键因素。南北阁实验室推出Nanbeige4.2 - 3B,在架构、数据构造和训练pipeline层面做了系统工作,评测表现良好,还探索本地个人助手等应用。
天天追货源,月月看涨价——存储芯片从业者的困局如何解?
2026年上半年,由AI算力需求引发存储芯片“超级周期”,全球供需失衡,价格飞涨。“芯片通胀”从产业链上游传导至消费者。同时,中国存储力量强势崛起,还盘点了“第八届硬核芯”存储赛道明星产品。
70万辆车同步升级,背后那套系统藏了六年
超70万蔚来和乐道车主收到最新版世界模型推送更新。蔚来用一套代码覆盖多品牌、多平台、多芯片、多传感器车型,其技术体系复杂,从2020年起搭建,六年未改底层逻辑,如今效果显现。
对话灵感实验室:全帧率 VLM、低成本与分层部署,业务现场不止需要炫技模型
InfoQ对话格灵深瞳灵感实验室,探讨多模态大模型下视频理解问题。指出传统视频模型抽帧处理浪费算力和信息,介绍LLaVA - OneVision - 2.0突破长视频理解瓶颈,还提及“视觉智能工坊”助力业务落地。
开源屠刀!400美元炼成「代码副脑」,硅谷天价模型成废铁
AI2开源Open Coding Agents,以最低数百美元算力成本,能训练贴合私有代码库的专属编程智能体。SERA-32B表现惊艳,其软验证生成技术降低成本,新代码易部署且兼容Claude Code。
专访中科第五纪黄岩:在具身智能的狂热中,做一位技术实干家
机器之心专访中科第五纪黄岩,他在具身智能狂热中是技术实干家。其有学术和工业界双重身份,技术覆盖多领域。团队解决行业数据利用瓶颈,推出超少样本大模型等成果,在商业落地表现出色。
晟德微×北京君正:国产毫米波雷达赋能两轮车智能化
汽车产业智能化推动两轮车迎来‘汽车级’升级,政策与市场需求让毫米波雷达成新引擎。晟德微携手北京君正开发两轮车专用毫米波雷达,采用其Cheetah系列芯片,适配多种场景,将加速方案落地。