CUDA Programming GuideCUDA 编程指南中文图解
首页
阅读地图
1.1 Introduction
PDF 图版
  • 源代码仓库(GitHub)
  • CUDA Programming Guide Release 13.3
  • NVIDIA 官方在线目录
  • 本地原始 PDF
首页
阅读地图
1.1 Introduction
PDF 图版
  • 源代码仓库(GitHub)
  • CUDA Programming Guide Release 13.3
  • NVIDIA 官方在线目录
  • 本地原始 PDF
  • 开始阅读

    • 阅读地图
    • PDF 图版
    • 来源与版本

阅读地图

本页按 NVIDIA 官方在线目录和项目内 PDF 的顶层结构整理。官方在线目录最后更新日期为 2026-05-27;本地 PDF 封面同样标注 Release 13.3。点击分节进入中文译稿与概念说明。

原 guide 的六个部分

原文部分中文入口官方范围本站内容
1. Introduction to CUDA第一部分:CUDA 简介Introduction、Programming Model、The CUDA platform1.1–1.3 已按官方网页逐段翻译,含图 1–10 与脚注
2. Programming GPUs in CUDA第二部分:用 CUDA 编程 GPUCUDA C++、CUDA Python、SIMT、Tile、异步、内存、nvcc2.1–2.7 已按官方网页逐节翻译,含代码、表格、图 11–21 与边界说明
3. Advanced CUDA第三部分:高级 CUDA高级 API、kernel、Driver API、多 GPU、CUDA 功能导览3.1–3.5 已按官方网页逐节翻译,含代码、表格、图 22–23 与 PDL 图示
4. CUDA Features第四部分:CUDA 功能20 个当前功能主题4.1–4.20 已按官方网页逐节翻译,含代码、表格、图 24–57 与功能说明
5. Technical Appendices第五部分:技术附录Compute Capability、语言、浮点、设备端 API、模型5.1–5.8 已按官方网页逐段翻译,含代码、表格、脚注与浮点图示
6. Notices第六部分:声明Notice、OpenCL、Trademarks6.1–6.3 已按官方网页完成中文译文,法律文本保留版本边界

推荐路线

A. 第一次学习 CUDA

异构系统 → grid/block/thread → warp/SIMT → global/shared/register → kernel launch → 同步与错误检查

先读第一部分中的编程模型,再看第二部分的 CUDA C++ 最小心智模型。

B. 关注性能

线程块调度 → warp divergence → 合并访问 → 共享内存 bank conflict → occupancy → 异步流水线

推荐同时查看图 14 的全局内存转置和图 15 的共享内存 bank conflict。

C. 查版本敏感功能

直接进入CUDA 功能。每个条目都保留官方英文名称;页面中的“适用性提示”只做阅读导航,真正的 compute capability、驱动和 API 限制请以 NVIDIA 官方页面为准。

中文稿状态

结构

按官方 6 个顶层部分和在线目录的主要分节建立导航。

逐段翻译

第一部分 1.1–1.3、第二部分 2.1–2.7、第三部分 3.1–3.5、第四部分 4.1–4.20、第五部分 5.1–5.8 与第六部分 6.1–6.3 已和官方网页逐段核对。

图版

原 PDF 图 1–57 已按页保留并附中文解释,章节正文同时使用官方图示资源。

版本核对

保留 Release 13.3 和官方在线目录入口,方便发现后续版本差异。

阅读边界:当前目录中的六个部分均已完成对应官方网页的中文译文;法律文本、代码标识符、API 名称、公式和版本限制仍应以 NVIDIA 发布的最新版英文文档为准。涉及生产环境或新硬件时,请将本文与官方文档并读。
Next
PDF 图版