「GPU 虚拟化」共找到 1279 篇相关文章
单机狂飙4万亿参数,国产AI「四大天王」首次合体!这台超节点鲨疯了
国产「四大开源天王」可在单机运行,背后是「元脑SD200」超节点。它有超大显存、高速互联域和超强算力,支持64路本土GPU且可商用。浪潮信息以开源为战略加速大模型商业化落地。
【博客转载】CUDA Cooperative Groups
文章介绍CUDA cooperative groups,它让开发者创建和管理能同步通信的线程组,为GPU并行算法编程提供更灵活高效方式。文中讨论并行归约算法及用cooperative groups的实现,还对比不同归约求和方法及性能。
组织也能fork?Karpathy提出"代码即公司"
Karpathy提出“代码即公司”观点,认为AI驱动的组织可像代码仓库一样被复制、修改、迭代。传统组织因“制度性知识”难以fork,AI能将隐性知识显性化。交易公司或成首个被fork的组织类型,管理协调是核心竞争力。
不止萌兔蹦迪!狸花猫竖中指,吃奶婴儿开飞机,魔性AI视频让人停不下来
AI正席卷短视频,从“兔子蹦床”到“婴儿开飞机”,魔性剧情吸睛又迷惑,背后是算法驱动的流量生意。虚假内容泛滥,4大YouTube频道已全面AI化,“AI垃圾”或已暗中攻占人类心智,是时候普及“AI防诈”知识了。
独家|能量桥完成新⼀轮融资,Monolith领投,中科创星跟投
近日,能量桥完成新一轮融资,由 Monolith 砺思资本领投,中科创星跟投。该公司核心团队经验丰富,其预制化超导能源模块可实现数据中心配电零损耗。在 AI 算力建设背景下,超导技术或成输电破局点。
剑桥揭开大模型翻车黑箱!别再怪它不懂推理,是行动出错了
剑桥大学等机构研究指出,大模型执行长时任务易翻车,问题不在推理而在执行能力。研究人员评估多个指标,发现单步准确率提升可让任务长度指数增长,还研究了自条件化等影响及模型规模的作用。
Unsloth宣布更新,可免费用强化学习训练视觉大模型Qwen2.5-VL-7B
Unsloth宣布更新,支持视觉/多模态模型强化学习训练,含Gemma 3和Qwen2.5 - VL。其独特机制使VLM RL训练速度提升、显存占用降90%等。还引入GSPO算法,能在免费Colab T4 GPU训练Qwen2.5 - VL - 7B。
伯克利神作背刺OpenAI:持续学习才是真神!
伯克利等机构发布FST框架,通过快慢分层解决大模型持续学习死局。过去两年头部实验室都在提升模型推理能力,却忽视持续学习。FST让模型像大脑一样快慢分层,提升数据效率、减少遗忘,使持续学习可工程化。
老黄秘密武器曝光:AI一夜设计芯片,顶人类顶级工程师10个月!
英伟达在GTC大会揭露用AI设计GPU,原本8名工程师10个月的任务,AI一夜完成。其开发NB - Cell、Prefix RL等工具,还推出内部大模型Chip Nemo和Bug Nemo,不过完全端到端自动化设计仍有距离。
双手取货+漂移搬运,WRC明星机器人告诉大家:什么是高级操作|甲子光年
去年90后创业者王鹤提出具身智能产品化思路,一年后银河通用在零售和工业找到业务切口。2025 WRC上其Galbot机器人表现亮眼,会前还发布银河太空舱,开启‘十城百店’计划,以务实方式推动人形机器人商业化。