「高性能计算芯片」共找到 2900 篇相关文章
SkyReels-Audio让嘴型和音频完美匹配不再难
音频驱动的动态人脸生成研究较少,昆仑万维提出SkyReels - Audio框架,基于预训练视频扩散变换器构建,支持无限长度视频生成与编辑,采用混合课程学习等策略,保障视频视觉保真度和时间一致性。
刚刚,智源全新「悟界」系列大模型炸场!AI第一次真正「看见」宏观-微观双宇宙
6月6日第七届智源大会,智源研究院推出全新「悟界」系列大模型,含原生多模态世界模型Emu3、脑科学多模态通用基础模型见微Brainμ等,反映其对大模型发展的研判,推动AI向物理世界迈进。
矩阵乘法新突破!XX^T原来可以更快!RL助力搜索,世界纪录又被提升了5%
深圳市大数据研究院、香港中文大学(深圳)研究团队,结合强化学习与组合优化技术,发掘新算法 RXTX,让 XX^T 运算减少 5% 运算量,成果在国际引发关注,不过产业化落地仍面临挑战。
谷歌开源基于物理模拟的气象模型,能预测暴雨、台风、大干旱
传统通用循环模型处理小尺度有局限,谷歌开源基于物理模拟的神经通用环流气象模型NeuralGCM,在预测突发恶劣天气出色,还介绍其动态核心、物理模拟模块等,经测试有一定优势。
开源即屠榜!UniME多模态框架登顶MMEB全球训练榜,刷新多项SOTA纪录
格灵深瞳等团队联合发布通用多模态嵌入新框架UniME,刷新MMEB训练榜纪录。它是两阶段框架,经文本判别知识蒸馏和困难负样本增强指令微调,在多任务达SOTA,项目已开源。
Anthropic滑跪认错!Claude暗中降智实锤
开发者argofowl排查后发现Claude Code将「high」推理程度读成原本「low」对应的值,原来Anthropic在做实验。科技博主曝光后AI圈炸锅,工程师虽回应,但Opus 5也被指降智。
SGLang 中的 CUDA Graph 进阶指南
本文介绍 SGLang 构建 CUDA Graph 支持及改动。如 Runner/Backend 解耦与灵活组合;首创 Breakable CUDA Graph 并开源,能提高捕获灵活性;还实现 Prefill 的 Full CUDA Graph,同时介绍显存管理方法。
逛完WAIC,我们发现这家芯企已经把端侧AI“场景落地”做实
7月17 - 20日,世界人工智能大会召开,端侧AI成热点。瑞芯微展台展示大模型、Agent、AI+应用,多方案已量产落地,其双轨架构优势突出,还规划了产品路线图。
大模型"温故而知新"实现了!无需历史数据,Octopus 效果超越全数据训练|CVPR‘26 Octopus
上海交通大学与vivo团队提出全新持续学习框架Octopus,首创无需历史数据的梯度正交化技术。实验显示,它在UCIT基准上表现超SOTA方法,还实现正向后向迁移,适合端侧部署。
零GPU,世界第一超算!深圳制造改写游戏规则了
中山大学教授带队、深圳制造的灵晟超算登顶全球超算TOP500榜单,零GPU采用纯CPU架构,全链路自研。图灵奖得主评价其为“AI4S新型架构的希望之光”,还在多领域展开应用。