「云端GPU」共找到 516 篇相关文章
一文看懂英伟达的产品体系和命名规则
文章由小枣君撰写,详细梳理英伟达产品体系和命名规则,涵盖算力芯片、超级芯片、超级计算机平台等,介绍各层级产品特性,还提及通信技术、开发框架CUDA,助读者清晰了解英伟达产品。
直击CES:黄仁勋演讲后4个小时,苏姿丰带着她的“复仇者联盟”上台了|甲子光年
CES 2026上,英伟达CEO黄仁勋演讲后约4小时,AMD董事长苏姿丰登场,展示全栈AI战略。发布Helios架构、新GPU产品及Ryzen AI平台等,走系统工程与长期演进路线,欲抢AI基础设施市场。
L4大方向有了:理想自动驾驶团队,在全球AI顶会上揭幕新范式
在全球计算机视觉学术顶会 ICCV 2025 上,理想汽车自动驾驶高级算法专家詹锟发表演讲,阐述了‘从数据到训练’的系统化思路,提出将世界模型与强化学习闭环落地于量产自动驾驶系统的完整架构。
量化噪声竟是RL秘钥?QeRL:高效强化学习新范式,一场噪声引发的性能革命
近年来,大语言模型在复杂推理任务中面临挑战,强化学习虽更接近人类推理过程,但训练“烧资源”。论文《QeRL》提出量化不仅能压缩模型、节省资源,还能增强模型探索能力,QeRL框架实现训练速度提升、内存占用减半。
告别随机性:Thinking Machines Lab如何实现了LLM推理的完全确定性?
文章指出LLM推理非确定性根源并非GPU并发和浮点非结合性,而是批大小变化致核函数非不变性。作者提出实现批不变操作的策略,实验验证有效,还阐述其对训练、系统可靠性等方面的意义。
完全离线!开源实时语音识别神器,本地实时语音转文字,秒级延迟+说话人识别!
实时语音转文字和说话人识别需求渐长,但传统工具多依赖云端,有隐私与延迟问题。GitHub上的开源项目WhisperLiveKit是本地化语音识别方案,速度快、延迟低、支持说话人识别,适合会议等场景。
编程革命彻底爆发!刚刚,OpenAI最强智能体上线ChatGPT
OpenAI发布云端AI编程智能体Codex,由codex - 1加持,多任务并行,半小时可干完数天软件工程任务。它能完成多项编程任务,还与GitHub集成。已向部分ChatGPT用户开放,Codex CLI也有更新。
手机跑多模态也能快到飞起!面壁MiniCPM-V 4.6开源
面壁智能开源多模态模型MiniCPM-V 4.6,以低算力成本、超低首Token延迟打通三大主流手机操作系统。它算力瘦身性能强,是视觉语言多面手,还适配主流系统,降本增效,让AI能力从云端到指尖。
免费开源、可本地部署的AI私人助理Clawdbot,保姆级搭建教程来了
本文提供免费开源、可本地部署的AI私人助理Clawdbot的搭建教程。它能在多平台运行、连接工具和技能。教程涵盖创建虚拟机、安装Node.js和Clawdbot、设置连接等步骤,还介绍技能扩展和VPS运行方案。
把具身机器人开发变简单,地瓜机器人S600与一站式平台双擎亮相
11月21日地瓜机器人在深圳举办开发者大会,带来S600具身智能机器人大算力开发平台和一站式开发平台。从硬件到云端全面赋能,加速具身智能机器人全链路发展,还宣布了战略客户与合作伙伴。