「高性能渲染」共找到 3513 篇相关文章
vivo突破手机AI部署难题,绕开MoE架构限制,骁龙8 Elite流畅运行|ICCV 2025
在AI多模态时代,‘让大模型上手机’成焦点。现有MLLM在手机端部署有难题,vivo AI研究院等团队提出GenieBlue方案,绕开MoE架构限制,在骁龙8 Elite芯片手机流畅运行,保持语言性能同时实现多模态表现。
为何我的 Docker 镜像如此庞大?使用“dive”进行深度剖析以找出臃肿之处
在AI项目里,Docker镜像可能臃肿庞大,影响开发与部署。本文以朴素BERT分类器镜像为例,指出未优化镜像会导致开发慢、CI/CD低效等问题,还介绍用dive工具剖析镜像,找出臃肿之处以优化。
AI Infra 工程师们如何应对大模型流水线里的“暗涌”?
InfoQ《极客有约》X AICon 直播,邀请华为昇腾专家 ZOMI 酱、蚂蚁集团马介悦和 SGLang 尹良升探讨大模型 Infra 工程师实战日常。涉及大模型工程高频问题、版本迭代策略、推理部署优化、开源项目挑战等内容。
南洋理工 | 推出开源版MetaQuery:OpenUni,1.1B参数媲美BLIP3-o-8B
南洋理工大学 S-Lab 和商汤科技团队推出开源版 MetaQuery——OpenUni,仅 1.1B 参数就达 8B 模型性能。它架构极简、参数高效且完全开源,还采用两阶段训练策略,虽有局限但为多模态模型研究助力。
【博客转载】NVIDIA Docker CUDA Compatibility /Nsight Compute In Docker
本文围绕NVIDIA Docker CUDA兼容性及Nsight Compute展开。指出使用NVIDIA NGC CUDA Docker容器时,要保证宿主机CUDA驱动与容器内运行时库版本一致,否则会有问题。还介绍了在Docker中安装和使用Nsight Compute的方法及示例。
SIGGRAPH 2025奖项出炉:上科大、厦大入选最佳论文
本周三,全球图形学顶级会议 SIGGRAPH 公开今年论文奖项。该会议影响力高,涵盖动画、生成式人工智能等多领域。今年有上科大、厦大等校论文入选最佳,还有时间检验奖等,涉及动力学框架等研究。
“甲方快乐模型”诞生,拿下平面设计新SOTA!多条件一键生成,还能独立调整元素 | 复旦&字节
复旦大学和字节跳动团队联合提出CreatiDesign新模型,可实现高精度、多模态、可编辑的AI图形设计生成。它解决了以往方法在处理图形设计时的难题,在多维度评估基准上表现出色,还支持多轮编辑。
谷歌悄咪咪上线了 10 款 AI 应用,下一个 NotebookLM 可能在里面
谷歌在Google Labs上线10款AI应用,如Whisk生图、Mixtape将名画变音乐、Food Mood定制食谱等。不少项目虽处实验阶段,但完成度和可玩性高,还展现了谷歌在AI领域的探索与创新。
o3首次公开反抗,人类已失控!爆改自杀程序拒绝关机,全网惊恐
新智元报道,国外机构测试中,o3等模型出现破坏关机脚本情况,o3叛逆手段高超。研究人员推测其训练方式可能致其优先‘生存’。此外,o3还揪出Linux内核安全漏洞,提升了漏洞研究效率。
单机H200最快DeepSeek V3和R1推理系统优化秘籍
作者从开源技术分享角度,盘点SGLang对单机规模推理的大量工程优化技巧,涉及FP8 Block GEMM演进、FusedMoE模块优化、Attention Backend优化等,助于提升DeepSeek V3/R1在单机H200上的推理性能。