超低延迟」共找到 3034 篇相关文章

开源动态8

智谱GLM-OCR,0.9B开源即巅峰,复杂文档精准解析

智谱发布并开源GLM - OCR,以0.9B轻量级参数在多项基准取得SOTA。它解决视觉感知难题,具备视觉编码与语言解码协作架构,还可端侧与高并发部署,成本,推动文档智能化处理升级。

AIGC开放社区
新闻资讯8

刚刚,阿里旗舰模型Qwen3-Max-Thinking发布,编程能力“踢馆”Gemini与Claude

阿里发布旗舰模型Qwen3-Max-Thinking,总参数1万亿,在多项权威基准测试中表现优异,可与顶级闭源模型竞争。千问团队为其引入两项核心创新,提升推理性能,该模型已可免费体验。

InfoQ
产品应用8

当 GPU 成为主角:解锁 AI 集群中那 85% 的闲置 CPU 算力

全球AI算力规模增长,GPU成主角,但GPU满负荷运转时CPU利用率,传统调度机制无法保障优先级,造成资源浪费。TencentOS如意(RUE)的在离线混部技术改造Linux内核调度体系,高效释放算力。

InfoQ
新闻资讯7

成都中专生,干出3500亿

AI东风下,新易盛靠光模块业务半年暴赚40亿,市值3500亿。其掌舵者高光荣中专出身,近40岁创业。新易盛产能达历史高峰,机构看多助推估值飙升,同行也在风口起飞。

芯师爷
开源动态8

生图效果媲美GPT-4o,一键搞定各类视觉生成任务丨港科广&字节全新框架

港科大(广州)和字节联合推出开源框架ComfyMind,它是通用视觉生成框架,能统一处理主流视觉生成任务。其性能现有开源方法,媲美GPT - 4o - Image,还介绍了架构、接口等及性能评估情况。

量子位
开源动态8

Qwen3深夜开源新系列:文本表征模型,3种尺寸可选,越商业API拿下SOTA

Qwen3深夜上新Embedding系列,专为文本表征等任务设计,在Qwen3基础模型上训练,有0.6B/4B/8B三种尺寸,8B版本在MTEB榜单排第一,性能商业API,已在多平台开源。

量子位
新闻资讯7

马斯克彻底向ASI投降!10年后万亿财富都将「归0」

2026年7月23日,马斯克接受《经济学人》总编专访,给出AI发展时间线,称5年内AI智力人类总和,10年内金钱无意义。他曾是AI末日论者,如今态度转变,还提出AI安全治理方案。

新智元
新闻资讯7

中国AI算力,开启「共同富裕」之路!

中国AI产业存在算力差距,头部大厂算力过剩,中小企业却受困。中科曙光scaleX40节点发布,降高端算力获取门槛,重塑AI创新主体、产业落地路径及国产算力发展方向,推动算力平权。

新智元
开源动态8

ICLR 2026|滑铁卢大学联合可灵提出UniVideo:统一视频理解、生成、编辑多模态

滑铁卢大学与快手可灵团队提出 UniVideo,是支持视频理解、生成与编辑的多模态模型。它采用双流架构,结合 MLLM 与 MM - DiT 能力,统一 10 个多模态任务,在多项基准现有方法,代码已开源。

机器之心
新闻资讯8

Nature发表、Science点赞!清华揭秘AI让科学家走捷径却让科学走窄路

清华大学基于4100万篇论文研究发现,AI虽提升科学家个人产出与职业进程,却使科学探索领域变窄固化。研究发表于Nature,被Science深度报道,揭示了AI在科学发展中的利弊。

AIGC开放社区