CUDA Programming

host: CPU
device: GPU
nvcc: CUDA 编译器
gridDim: 1个grid中有多少个block
blockDim: 一个block中有多少个线程
blockIdx: 当前线程所属的block序号,同一个block中的所有线程共享这一个blockIdx
threadIdx: 当前线程在当前block中的序号

dim3

Executed on the: Only callable from the:
__device__ float DeviceFunc() Device Device
__global__ void KernelFunc() Device Host
__host__ float HostFunc() Host Host