上科大」共找到 6444 篇相关文章

新闻资讯8

这个春节,AI 不聊天了,开始替我买单

马年春节,腾讯、百度、字节跳动等厂打响「AI 春节战」。阿里旗下千问 APP 投入 30 亿启动「春节请客计划」,活动首日成绩显赫,还展示了跨应用调度等能力,探索出独特的「超级 Agent」路线。

机器之心
新闻资讯7

美联储杀人,AI埋尸?牛津曝光L型死局:10亿打工人再无归路

牛津学实证研究表明,2022年全球裁员并非因AI,而是宏观经济周期所致。美联储加息使风投融资减少,企业为生存裁员,却把锅甩给AI。如今技岗位呈‘L型’停滞,AI让失业变永久。

新智元
开源动态8

多模型共享 GPU 内存,Berkeley 开源新工具

GPU内存利用率低是模型部署痛点,伯克利Sky Computing Lab团队开源kvcached工具,通过虚拟化技术让多模型共享显存。它引入虚拟内存概念,按需分配,测试显示能提升效率,安装简单、兼容性好。

AI工程化
产品应用7

关于Nsight Compute中Compute Workload Analysis反映的Tensor Pipe Uti的理解

文章分析Nsight Compute中Compute Workload Analysis反映的Tensor Pipe Uti异常现象。通过实验和推算,发现ncu对L20 GPU特定指令用错误执行延迟算指标,导致异常,还给出GEMM Kernel性能分析建议。

GiantPandaLLM
产品应用8

嚯!国产视频模型的物理水准超神了 | 实测MiniMax海螺02

MiniMax新视频生成模型Hailuo 02,解决了AI视频生成中体操难题。该模型原生支持1080p,能处理极端复杂物理场景,实测文生、图生视频能力出色,成本创新低,MiniMax本周还有多项技术布局。

量子位
开源动态7

Meta Shuffling的MoE Grouped GEMM kernel benchmark

作者拷贝fbgemm开源的moe grouped gemm kernel,修复小bug后与SGLang的Grouped GEMM Triton Kernel对比,结果显示fbgemm在MoE模型性能提升显著,可应用到SGLang的ep - moe的grouped gemm kernel中。

GiantPandaLLM
开源动态8

SmolVLA: 让机器人更懂 “看听说做” 的轻量化解决方案

文章介绍轻量级开源视觉 - 语言 - 动作 (VLA) 模型 SmolVLA,专为机器人领域设计,可在消费级硬件运行。它用公开数据集训练,架构经优化,还引入异步推理堆栈,性能超部分模型,降低研究门槛。

Hugging Face
开源动态8

华为| 祭出FlashComm1,FlashComm2、FlashComm3,解决LLM推理通算瓶颈

模型推理面临通算难题背景下,华为数学家祭出FlashComm 1、2、3。如FlashComm 1优化AllReduce通信,提升推理性能;FlashComm 2重构计算流程,提升推理速度;FlashComm 3实现多流并行,激增模型吞吐。

AINLPer
新闻资讯7

山姆•奥特曼:ChatGPT 用户有三层代沟

OpenAI的CEO山姆•奥特曼在红杉闭门演讲中透露,不同年龄层使用ChatGPT方式不同,老年人当谷歌替代品,二三十岁的人当生活顾问,学生当操作系统,这反映了AI与人类交互模式的转变。

AGI Hunt
推荐文章7

同一模型便宜50%,API Hub靠什么赚钱?

文章探讨模型API Hub低价卖Token现象,指出低价出售的常是闲置算力等。分析厂商不官网降价原因,介绍第三方低价来源及Hub盈利途径,给出判断低价Hub能否用的检查清单。

AI Reading Hub