计算效率」共找到 1778 篇相关文章

新闻资讯7

老黄太难了!英伟达Q2营收467亿美元创纪录,股价盘后还跌了5%

英伟达Q2财报营收和每股收益超预期,达467亿美元,数据中心业务贡献大,Blackwell平台表现亮眼。尽管给出高营收指引并扩大回购授权,股价盘后仍下跌。各业务均有进展,正重新定义计算产业规则。

量子位
算法论文8

LLM本质上永远无法实现真正的正确推理

日本埼玉大学荣誉教授Jingde Cheng论文指出,以ChatGPT为代表的大语言模型(LLM)本质上无法实现真正的正确推理。论文定义了“正确推理”,从逻辑和计算原理论证其局限性,为推理智能体研究指明方向。

深度学习自然语言处理
开源动态8

视觉Token注入CLIP语义,走向多模态理解与生成新范式

腾讯ARC Lab等机构提出全新视觉分词器TokLIP,将低级视觉Token与高级CLIP语义结合,支持端到端自回归训练,可接入LLM框架,降低计算与数据门槛,在多模态任务中表现优异,代码已开源。

量子位
新闻资讯7

老外给中国 AI 开源厂商打分:第一梯队是 DeepSeek 和 Qwen。

Nathan Lambert发布“中国开源模型开发商排名”,评估19家实验室贡献,第一梯队是DeepSeek和Qwen。还介绍字节跳动豆包、小米、百度文心一言发展情况,如豆包月活全球第二,小米模型效率突破,文心一言企业应用领先。

AI进修生
开源动态8

开启RL Scaling新纪元,siiRL开源:完全分布式强化学习框架,支持超千卡规模高效训练

传统强化学习框架在模型和集群规模达上千块GPU时,存在扩展性瓶颈和效率低下问题。上海创智学院团队推出siiRL,采用全分布式架构和多控制器范式,解决传统框架痛点,在多方面验证了其高性能。

机器之心
新闻资讯8

图灵奖得主Hinton国内首次现身演讲:AI超越人类后,我们该怎么做

在世界人工智能大会WAIC上,图灵奖得主杰弗里・辛顿发表演讲,围绕AI历史、未来等展开。他认为大语言模型与人类理解语言方式相似,数字智能知识分享效率远超人类,还提议构建网络让AI向善。

机器之心
新闻资讯7

穿上唐装,黄仁勋在急什么?

北京时间7月16日,黄仁勋穿唐装在「链博会」演讲。此前英伟达H20芯片获出口资格,RTX Pro芯片将在华发售。他与雷军聊AI和小米汽车,谈H20芯片、Meta抢人等话题,还称财务自由无梦想。

芯师爷
推荐文章7

【博客转载】CUDA Local Memory

文章围绕CUDA本地内存展开,介绍其为线程私有存储空间,访问特性与全局内存类似。通过两个计算滑动平均值的CUDA kernel示例,展示数组索引复杂度对存储位置的影响,还给出判断存储位置的方法及优化建议。

GiantPandaLLM
算法论文8

无损减少80%激活值内存,提升5倍训练序列长度,仅需两行代码

港中文(深圳)和上海交通大学团队提出 StreamBP 算法,通过线性分解和分步计算,将大语言模型训练激活值内存降至梯度检查点的 20%,在相同内存下最大序列长度为其 2.8 - 5.5 倍,代码已开源。

机器之心
产品应用8

拳打可灵,脚踢 Veo 3,谁是物理世界的「懂王」?

多模态视频生成大模型是复杂系统工程,多为巨头游戏。MiniMax的Hailuo 02发布,ELO得分超谷歌Veo 3和快手Kling 2.0。它能呈现复杂运动,处理物理关系,提升训练推理效率,成本低,后续还将更新。

AI科技评论