「GPU内核算法」共找到 1007 篇相关文章
英伟达通用机器人芯片来了:AI算力提升7.5倍,宇树、银河通用已搭载
本周一,英伟达发布新一代机器人专用芯片Jetson Thor,算力是上一代7.5倍,能效3.5倍,内存容量翻倍。适配新算法,支持多种模型,已受大量厂商重视,相关产品已发售或开放预订。
Turso:用 Rust 重写 SQLite,让数据库跑在每一个边缘节点
Turso用Rust重写SQLite内核,解决其单写者限制和缺乏网络同步能力的短板。它有嵌入式副本、边缘同步和向量搜索等特性,适用于AI Agent、多租户SaaS等场景,与竞品相比优势独特。
刚刚,OpenAI前CTO:战胜LLM不确定性的方法找到了!
OpenAI前CTO创立的Thinking Machines Lab发布研究《战胜LLM推理中的不确定性》。研究指出LLM推理不确定性主因是批处理大小变化,而非常见认为的GPU并行性等。还给出实现批处理不变性的方案及实验结果。
DeepSeek悄悄更新:Mega MoE、FP4 Indexer来了
昨天下午,DeepSeek 更新了 DeepGEMM 代码库,带来新东西 Mega MoE。它将 MoE 计算流程整合,让数据通信和计算同时发生,提高 GPU 利用率。还尝试组合精度、搞 FP4 indexer 等,是基础设施层重构尝试。
李飞飞的创业公司放大招:只要一个 H100 就能跑世界模型
“AI 教母”李飞飞的创业公司 World Labs 推出高效世界模型 RTFM,只需一个 H100 GPU 就能一边和用户交互,一边实时渲染 3D 世界,显著降低硬件成本和部署难度,渲染效果也不俗。
MIT工科生跨界AI,独作论文登Nature:只需3.5小时修复600年前名画
MIT理工男Alex Kachkine跨界艺术,独作论文登Nature。他设计的AI算法将名画修复时间从数月/数年压缩至几小时,提出“以数字方式修复一幅画,并在物理上实现效果”的新方法。
十分钟破解加密货币!谷歌在量子计算领域发现了什么?
谷歌提前后量子密码迁移截止日期至2029年,两篇论文从不同层面优化Shor算法,显示量子计算机破解现有密码体系所需资源比预想少。以太坊架构使其面临更广攻击面,比特币也有局部隐患。
英伟达发射了首个太空AI服务器,H100已上天
11月2日,英伟达首次将H100 GPU送入太空,搭载于Starcloud-1卫星测试AI处理应用。太空数据中心能源成本低、不占土地、少排温室气体,Starcloud计划未来大规模部署,还筹划后续任务。
哈佛发现基础模型比你想象中更强大:纯采样方法可超越RL
论文提出基础模型本身已具备强大推理能力,通过“幂采样”纯采样算法,在多推理任务上媲美或超越RL后训练,挑战“RL才能提升推理”观念,为理解基础模型潜力开新视角。
让RAG告别断章取义,HiChunk做到了~
现有RAG评测忽视文档切分,腾讯优图提出HiCBench评测基准和HiChunk框架。HiCBench含人工标注多级切分点与证据稠密QA,HiChunk用微调LLM建多级语义树,配Auto - Merge算法,实验效果佳。