推理训练数据」共找到 5141 篇相关文章

算法论文7

低延迟、高吞吐,LLM优化与高效推理引擎综述

LLM计算成本高,用户要低延迟,企业要高吞吐。工程师开发优化技术,如动态批处理、KV缓存、模型量化。论文对比25款推理引擎,还探讨了多模态支持、手机端推理、新型架构支持等进化方向。

深度学习自然语言处理
开源动态7

OpenAI公开大规模稳定训练的秘密,英伟达AMD英特尔都受益

OpenAI通过OCP开放超大规模AI训练用的网络协议MRC,它能确保大规模训练环境下网络通信稳定。该协议由OpenAI联合英伟达等厂商花两年完成,从拓扑、传输、路由维度保障网络可靠性。

量子位
产品应用7

关键技术详解|腾讯一念 LLM 分布式推理优化实践

InfoQ 邀请袁镱分享《一念 LLM 分布式推理优化实践》。介绍了“一念 LLM”设计思路、推理优化挑战与突破等,还对比不同框架,指出优化方向,如先实现 PP,再推进 EP 与 PD 分离。

InfoQ
产品应用7

用 Docker 跑大模型训练,Unsloth 解决了环境配置难题

Unsloth AI 发布 Docker 镜像版本,解决本地训练大模型环境配置难题。拉镜像就能训练,依赖和示例 notebook 都打包好。使用简单,不过有暂不支持 Mac 系统等限制,单卡 NVIDIA GPU 场景较适用。

AI工程化
推荐文章7

AGI 路线图第二阶段:游戏即模型训练|AGIX PM Notes

文章围绕AGI展开,介绍AGI路线图第二阶段“游戏即训练”,指出游戏是训练agent的理想环境;还提及Dreamer系列研究进展。同时涵盖本周市场动态、多家公司AI动态及ETF复制指数的方法、优劣和影响。

海外独角兽
8

AI Infra入门干货总结:大模型是如何高效推理

作者深入研读vLLM源码,以Llama 3为例,聚焦Decoder-Only架构LLM,介绍推理各环节及张量维度变化,讲解连续批处理和Paged Attention概念,还阐述推理流程、采样策略等,最后总结相关拓展内容。

腾讯技术工程
算法论文8

Meta「透视」AI思维链:CRV推理诊断,准确率达 92%!

Meta FAIR团队在论文中提出CRV方法,可实时观察AI思维过程。它通过改造模型大脑结构,让推理可见。在算术推理实验中,检测精度提升到92.47%,还能让模型修正错误。不过该技术落地尚面临诸多挑战。

新智元
推荐文章7

一次缓存引发的文件系统数据不一致问题排查与深度解析

本文详述由自研分布式文件系统客户端 EFC 缓存架构更新引发的数据不一致问题排查过程。经多轮分析,发现是版本号回退致客户端读旧数据。修复后测试无异常,还揭秘部分 POSIX 接口底层情况。

阿里云开发者
开源动态7

开源免费!一键给Agent接入A股28个「全场景数据端点」

想让Agent分析股票,却因数据来源难解决而无法使用。现推荐开源工具包a - stock - data,可一键给Agent接入A股28个数据端点,无需API等复杂操作,具有零依赖、全栈架构等特点。

开源AI项目落地
开源动态8

自定义轨迹驱动AI视频生成,ATI无需训练适配多种生成模型

字节提出视频生成运动控制统一框架ATI,通过轻量级运动注入器将用户定义轨迹投影至预训练图像 - 视频生成模型潜在空间,实现协调控制。用户指定关键点及路径控制运动,无需重新训练,适配不同架构。

带你学AI