「CUDA 代码生成」共找到 3606 篇相关文章
记录下SGLang 开发,debug的几个技巧第二弹
作者BBuf继上次分享后,又带来SGLang开发、debug新技巧。包括开启多线程加载模型权重,介绍SGLang Serve模型短期和长期崩溃的调试方法,还提及逐层NVTX Profiling、查看固定batch_size下Decoding性能等技巧。
PPIO姚欣:AI正在进入自主行动与创造时代,智能体需要全新的操作系统|MEET2026
在量子位MEET2026智能未来大会上,PPIO姚欣表示AI进入自主行动与创造时代,Agent会成未来AI主力,Agent Infra将成新操作系统。PPIO构建AI云能力,还推出Agent沙箱助力厂商落地。
首页大翻新,Agent HQ 上线!回归微软后,GitHub 不再是你认识的 GitHub 了?
2025 年 GitHub 回归微软后再出发,新负责人 Jared Palmer 带来变革。发布 Agent HQ 整合第三方编码代理,重构首页成工作起点。GitHub 正从代码托管走向开发者与智能体协同中枢。
告别VAE压缩损耗,南京大学用DiP让扩散模型回归像素空间,实现10倍加速与SOTA级画质
南京大学、腾讯优图实验室和新加坡国立大学发布DiP框架,即将开源。该框架不依赖VAE,仅增0.3%参数量,推理提效10倍,在ImageNet获1.79的FID分数,解决扩散模型在像素空间难兼顾质效的问题。
Gemini 3来了,Software 3.0也快了
作者认为Gemini 3是目前最好的模型,编程时前端用Gemini 3,后端用Codex。无编程需求时,它也能助力信息处理。Google推出Generative UI,二者结合让我们接近Software 3.0。
AAAI 2025 Oral | 火山引擎多媒体实验室提出VQ-Insight,AIGC视频画质理解大模型
火山引擎多媒体实验室与北大合作论文《VQ-Insight: Teaching VLMs for AI-Generated Video Quality Understanding via Progressive Visual Reinforcement Learning》入选AAAI 2026口头汇报。VQ - Insight用渐进式框架处理AIGC视频画质理解,实验表现卓越。
AI Native 的影像公司们,颠覆赛道的机会来了!
文章指出过去50年影像公司通过推动坐标点向「计算」端移动创造商业变量。如今计算突破天花板,带来理解、增强、生成现实三层价值释放,解锁新场景,AI Native影像公司机会巨大。
NeurIPS 2025|VFMTok: Visual Foundation Models驱动的Tokenizer时代来临
传统视觉 Tokenizer 存在缺乏高层语义信息、冗余度高、表征混乱等问题。香港大学 CVMI Lab 和阶跃星辰 AIGC 团队提出 VFMTok,用预训练视觉基础模型构造视觉 Tokenizer,实验显示其性能优异。
Python新版本去GIL刷屏,Karpathy 点赞敢死队,Python 之父:冷静,别神话并发
Python 3.14 正式发布,将“去 GIL”写进官方发行版,带来自由线程支持等能力,预估性能提升 3% - 5%。开发者看好,Karpathy 点赞,但 Python 之父认为去除 GIL 重要性被高估,强调工程常识。
GraphQA:用自然语言对话分析图数据
图数据常见但分析门槛高,需懂算法和代码。NetworkX 算法多却复杂,普通用户难上手。GraphQA 搭建桥梁,用自然语言接口替代复杂 API,智能选算法,继承 NetworkX 优势还解决易用性问题。