GPU内存共享」共找到 714 篇相关文章

算法论文8

SFT「不完全学习」之后,研究的下一个前沿在哪?ACL 2026 腾讯混元论文未来方向展望

本文从不完全学习现象出发,展望SFT领域未来研究方向,如未知根因探索、检测方法改进等,还提及推广到其他训练范式、CPT精细化研究等,给出研究优先级和社区建议。

InfoQ
新闻资讯8

看完智平方创始人郭彦东的这场演讲,我对 VLA 又有信心了

2026年具身智能赛道技术路线引争论,“VLA时代终结”论调扩散。智平方创始人郭彦东演讲回应,称VLA时代未终结,世界模型汇入VLA,关键变量是类脑架构,智平方技术成果和开源平台也证明VLA有生命力。

AI科技评论
新闻资讯7

当AI应用都在「撒钱」时,谁来扛住千亿交互背后的算力大考?

春节将至,AI应用竞争激烈,各大厂商纷纷「撒钱」。行业预测除夕当晚主流AI应用交互量或破千亿次,考验底层算力。Remy爆火时,共绩科技助其扛住流量冲击,其弹性算力调度优势明显,适合春节流量洪峰。

机器之心
开源动态8

5.2K Star!离线也能翻译,零网络高隐私,40+语言的纯本地翻译神器!

日常在线翻译服务有隐私、离线使用等问题,Argos Translate是100%本地运行的离线翻译方案,免费、隐私安全,支持40多种语言,具备多模态接口、GPU加速等功能,适合多种场景。

开源星探
算法论文8

与DeepSeek-OCR不谋而合,NeurIPS论文提出让LLM像人一样读长文本

NeurIPS 2025 论文提出 VIST 框架,为大语言模型长文本推理提供视觉方案,与 DeepSeek - OCR 理念不谋而合。它模仿人类阅读,有快 - 慢路径协作,在多任务表现优,还让模型‘用眼看文字’,优势明显。

机器之心
新闻资讯8

奥特曼豪赌万亿算力,OpenAI估值万亿美元 | 新智元ASI产业图谱10月号

新智元更新ASI产业图谱十月号,聚焦前沿模型、开源模型及世界模型与具身智能。介绍了模型排名情况,指出OpenAI现‘算力饥渴’,还提及国产模型、应用突破,强调算力将成AI竞争关键。

新智元
推荐文章7

【CUDA 博客】使用PTX指令更高效地加载和存储矩阵

文章围绕使用PTX指令高效加载和存储矩阵展开,介绍`ldmatrix`和`stmatrix`指令格式、适用GPU版本、地址计算逻辑等,给出不同矩阵数量的实现代码示例,助读者理解和应用。

GiantPandaLLM
推荐文章7

【CUDA博客】关于TensorCore和Inline PTX Assembly的一个超简短笔记

文章围绕TensorCore和Inline PTX Assembly展开,介绍利用PTX指令发挥TensorCore潜力。讲述矩阵乘法和累加操作,给出半精度及替代浮点指令形式,有代码示例并分析,还提到不同数据类型用法及SASS指令。

GiantPandaLLM
开源动态7

极客说|Unsloth 的全微调之路:从 Adapter 到 Full Fine-tuning

大语言模型参数多,微调难。Unsloth 原靠支持 Adapter 微调出名,现支持全参数微调,单卡就能搞定大规模模型训练。文章介绍其进化历程、关键技术、工程部署、使用优势及最佳实践。

AIGC开放社区
产品应用8

世界模型的DeepSeek时刻!魔芯Flash World Model降本70%,跑出50FPS实时交互

魔芯科技发布全球首个超高帧率交互式世界模型 MoWorld,无需高端 GPU,实现影视级画质、50 FPS 实时交互,降本 70%。其技术架构先进,产业化路径清晰,获过亿美元融资。

机器之心