CUDA Programming GuideCUDA 编程指南中文图解
首页
阅读地图
1.1 Introduction
PDF 图版
  • 源代码仓库(GitHub)
  • CUDA Programming Guide Release 13.3
  • NVIDIA 官方在线目录
  • 本地原始 PDF
首页
阅读地图
1.1 Introduction
PDF 图版
  • 源代码仓库(GitHub)
  • CUDA Programming Guide Release 13.3
  • NVIDIA 官方在线目录
  • 本地原始 PDF

CUDA 编程指南中文图解

对照 NVIDIA CUDA Programming Guide Release 13.3 的中文阅读站

从阅读地图开始查看 PDF 图版

以 PDF 13.3 为主线

章节名称、顺序和图版页码以项目内的 cuda-programming-guide.pdf 为准,并用 NVIDIA 官方在线目录做版本校对。

中文解释优先

保留 CUDA、warp、SM、PTX、API 等技术名词,围绕“它是什么、为什么这样设计、代码中怎么用”组织译文和导读。

图版不只贴图

每张选取的原 PDF 图版都标注 PDF 页码,并附上图中层级、数据流和实际编程含义的中文说明。

版本声明:项目内 PDF 的封面标注为 Release 13.3,日期为 2026-05-27。本网站不是 NVIDIA 官方翻译,适合学习和检索;遇到版本敏感的 API、硬件限制或合规问题,请回到官方文档核对。

六个入口

Part 1

CUDA 简介

异构系统、GPU 硬件模型、线程层次、SIMT、内存与 CUDA 平台。

Part 2

用 CUDA 编程 GPU

CUDA C++、CUDA Python、SIMT kernel、tile kernel、异步执行和 nvcc。

Part 3

高级 CUDA

高级 API、多 GPU、驱动 API,以及从功能角度浏览 CUDA。

Part 4

CUDA 功能

统一内存、CUDA Graphs、协作组、异步拷贝、虚拟内存等主题索引。

Part 5

技术附录

5.1–5.8 的 Compute Capability、语言扩展、浮点计算、设备端 API 与内存模型完整译文。

Part 6

声明与商标

6.1–6.3 的 Notice、OpenCL、Trademarks 中文译文与法律版本边界。

阅读建议

  1. 第一次接触 CUDA:先看1.1 Introduction,再看2.1 CUDA C++。
  2. 想理解性能:重点看线程块调度、warp divergence、全局内存合并访问、共享内存 bank conflict 和占用率。
  3. 想查新功能:直接看第四部分:CUDA 功能,每个条目都保留官方英文名,便于回到 NVIDIA 文档搜索。
  4. 想确认图形含义:进入PDF 图版,图下说明会把“图上画了什么”和“写 CUDA 时意味着什么”分开写。

翻译约定

  • API、宏、内建变量、编译选项、类型名和代码标识符保留英文,例如 threadIdx.x、cudaMalloc、__global__。
  • “thread block”译为“线程块”,“grid”译为“网格”,“warp”保留英文并在首次出现时说明为 32 个线程的执行组。
  • “device”在 CUDA 语境译为“设备(GPU)”,“host”译为“主机(CPU)”;不要把 device memory 与统一内存混为一谈。
  • 公式、代码和限制条件优先保留原意;中文段落是学习向翻译/导读,不替代 NVIDIA 的版本化 API 参考。