您的位置:首页 > 其它

cuda中各种类型的变量的总结(有转载的,有添加的)

2017-06-02 14:48 295 查看
1 定义和使用全局变量

[cpp] view
plaincopy

假设定义了全局变量 __device__ int *a;  

我需要一个数组,动态分配,那么直接调用cudaMalloc来为a分配内存的话,是不行的。

具体做法如下

[cpp] view
plaincopy

int *tmp;  

[cpp] view
plaincopy

cudaMalloc((void **)&tmp, sizeof(int) * num);  

      

  

cudaMemcpyToSymbol(a, &tmp, sizeof(int *),size_t(0), cudaMemcpyHostToDevice);  

使用cudaMemcpyToSymbol来把一个动态分配的设备指针写入一个静态的符号。所以是sizeof(int *),只是把指针写给a。

2. 定义和使用常量变量

1、赋值方法

__constant__ char g_chFuncIndex ;

cutilSafeCall( cudaMemcpyToSymbol( "g_chFuncIndex", i_chFuncIndex, sizeof( char ) ) ) ;

 

2、访问权限

   只可以在cuda的__global__ 或者__device__函数中访问,不可以在外部C函数(extern "C" )中使用

3.定义和使用共享变量

在__global__核函数内部定义__shared__float Mds[TILE_WIDTH][TILE_WIDTH];

直接使用即可。

4.定义和使用local类型变量

默认在__global__内部直接定义的int a,即为local类型的变量

5,

使用cudaMemcpyToSymbol来把一个动态分配的设备指针写入一个静态的符号。所以是sizeof(int *),只是把指针写给a。

拷贝数组:
__device__ double d_a[2];

int main()
{
    double h_a[2];

    h_a[0]=0.1;
    h_a[1]=0.2;
    
    cudaMemcpyToSymbol(d_a, h_a, 2*sizeof(double));

    return 0;
}

拷贝变量:
__device__ double d_a;
int main()
{
    double h_a;

    h_a=0.1;;
    
    cudaMemcpyToSymbol(d_a, &h_a, sizeof(double));

    return 0;
}
内容来自用户分享和网络整理,不保证内容的准确性,如有侵权内容,可联系管理员处理 点击这里给我发消息
标签: 
相关文章推荐