CUDA 编程指南中文图解
对照 NVIDIA CUDA Programming Guide Release 13.3 的中文阅读站
以 PDF 13.3 为主线
章节名称、顺序和图版页码以项目内的 cuda-programming-guide.pdf 为准,并用 NVIDIA 官方在线目录做版本校对。
中文解释优先
保留 CUDA、warp、SM、PTX、API 等技术名词,围绕“它是什么、为什么这样设计、代码中怎么用”组织译文和导读。
图版不只贴图
每张选取的原 PDF 图版都标注 PDF 页码,并附上图中层级、数据流和实际编程含义的中文说明。
版本声明:项目内 PDF 的封面标注为 Release 13.3,日期为 2026-05-27。本网站不是 NVIDIA 官方翻译,适合学习和检索;遇到版本敏感的 API、硬件限制或合规问题,请回到官方文档核对。
六个入口
阅读建议
- 第一次接触 CUDA:先看1.1 Introduction,再看2.1 CUDA C++。
- 想理解性能:重点看线程块调度、warp divergence、全局内存合并访问、共享内存 bank conflict 和占用率。
- 想查新功能:直接看第四部分:CUDA 功能,每个条目都保留官方英文名,便于回到 NVIDIA 文档搜索。
- 想确认图形含义:进入PDF 图版,图下说明会把“图上画了什么”和“写 CUDA 时意味着什么”分开写。
翻译约定
- API、宏、内建变量、编译选项、类型名和代码标识符保留英文,例如
threadIdx.x、cudaMalloc、__global__。 - “thread block”译为“线程块”,“grid”译为“网格”,“warp”保留英文并在首次出现时说明为 32 个线程的执行组。
- “device”在 CUDA 语境译为“设备(GPU)”,“host”译为“主机(CPU)”;不要把 device memory 与统一内存混为一谈。
- 公式、代码和限制条件优先保留原意;中文段落是学习向翻译/导读,不替代 NVIDIA 的版本化 API 参考。
