c++ - 使用 CUDA 在 GPU 之间复制大数据-6ren

c++ - 使用 CUDA 在 GPU 之间复制大数据

转载作者：太空宇宙更新时间：2023-11-04 01:06:44

57

4

我是 CUDA 的新手，我自己正在尝试一项非常简单的任务——将内存复制到显卡，然后再复制回来。这是我编写的代码的简化版本。

const int arraySize = 100; 

int* data1 = NULL; 
int* data2 = NULL;
// Initialized both data1 and data2
// ... 

int* dev_data1 = NULL; 
int* dev_data2 = NULL; 
// Initialized both dev_data1 and dev_data2
// ... 

// copy data1 to device
cudaMemcpy(dev_data1, data1, arraySize*sizeof(int), cudaMemcpyHostToDevice );

// copy dev_data1 to dev_data2 with gpu
gpuCopy<<<1, arraySize>>>( dev_data1, dev_data2 ); 

// copy dev_data2 to data
cudaMemcpy(data2, dev_data2, arraySize*sizeof(int), cudaMemcpyDeviceToHost );

而gpuGopy如下:

__global__ void gpucopy( int* src, int* dst )
{
    int i = threadIdx.x;
    dst[i] = src[i];
}

我发现如果 arraySize 很小，上面的函数就可以工作。但如果 arraySize 达到特定大小，data2 将变为全零。我的猜测是运行 gpu 函数时存在某种限制。但是有办法找出来吗？如果我有一个非常大的数组，我如何将它复制到 GPU(并返回)？

最佳答案

首先你应该做proper cuda error checking

其次，您可能认为 threadIdx.x 给出了一个全局唯一的线程 ID。它没有。

因此修改您的内核行:

int i = threadIdx.x;

到:

int i = blockIdx.x * blockDim.x + threadIdx.x;

最后，您的每 block 线程参数不能超过 512 或 1024，具体取决于 GPU。我们通过指定每个 block 的线程数和每个网格参数的 block 数来启动更大的网格:

#define nTPB 512
gpuCopy<<<(arraySize + nTPB - 1)/nTPB, nTPB>>>( dev_data1, dev_data2 );

结合这种网格大小调整方法，我们通常在内核中包含线程检查，以防止对任意网格/问题大小的越界访问:

__global__ void gpucopy( int* src, int* dst, int size )
{
    int i = threadIdx.x + blockDim.x * blockIdx.x;
    if (i < size)
      dst[i] = src[i];
}

同样，我们必须告诉内核问题的大小:

gpuCopy<<<(arraySize + nTPB - 1)/nTPB, nTPB>>>( dev_data1, dev_data2, arraySize );

您可能想要查看 CUDA programming guide

关于c++ - 使用 CUDA 在 GPU 之间复制大数据，我们在Stack Overflow上找到一个类似的问题： https://stackoverflow.com/questions/21790352/

57

4

0

文章推荐： c - 在 C 函数中声明 vector 时出错

文章推荐： ios - iPhone/iPad 宏或 c 函数？

文章推荐： c - Makefile: ...是最新的

文章推荐： javascript - NodeJS 请求和错误处理

iphone - 复制(复制)核心数据记录和相关记录
我正在编写一个应用程序，允许用户创建一个“问卷”，然后向其中添加问题。我正在使用核心数据来存储信息。我创建了一个问卷实体，并与问题实体建立了“一对多”关系。我的问题是，如果要允许用户复制(复制)整个调
Android:复制/复制 SharedPreferences
有没有办法复制或复制 SharedPreference？或者我需要从一个变量中获取每个变量，然后将它们放入另一个变量中吗？最佳答案尝试这样的事情: //sp1 is the shared pref
objective-c - @property(复制)与方法[复制]
下面的(A)和(B)有区别吗？ (假设 NON ARC，如果重要的话) // --- (A) --- @interface Zoo : NSObject{} @property (copy) Dog
php - 复制/复制/克隆 mysql_result 对象
我正在尝试将 mysql SELECT 查询保存到文件中，如下所示: $result = mysqli_query($db,$sql); $out = fopen('tmp/csv.csv', 'w'
ios - 使用 CVPixelBufferCreate 复制/复制 CVPixelBufferRef
我需要创建一个 CVPixelBufferRef 的副本，以便能够使用副本中的值以按位方式操作原始像素缓冲区。我似乎无法使用 CVPixelBufferCreate 或 CVPixelBufferCr
c# - 使用 Naudio 复制 Wave 文件 - 复制/附加最新的可用字节
我在 Source 文件夹中有一个 Active wave 录音 wave-file.wav。我需要使用新名称 wave-file-copy.wav 将此文件复制到 Destination 文件夹。
autotools - 文件由 `make dist` 复制，但未由 `make distcheck` 复制
在使用 GNU Autotools 构建的项目中，我有一个脚本需要通过 make 修改以包含安装路径。这是一个小例子: configure.ac: AC_INIT(foobar, 1.0) AC_PR
mysql - 使用 blob/text 复制/复制 SQL 行，怎么做？
我想将 SQL 的行复制到同一个表中。但是在我的表中，我有一个“文本”列。使用此 SQL: CREATE TEMPORARY TABLE produit2 ENGINE=MEMORY SELECT
python Pandas DataFrame 复制(deep=False)vs 复制(deep=True)vs '='
谁能给我解释一下 df2 = df1 df2 = df1.copy() df3 = df1.copy(deep=False) 我已经尝试了所有选项并执行了以下操作: df1 = pd.DataFram
Hazelcast 复制？
Hazelcast 是否具有类似于 Ehcache 的复制？ http://www.ehcache.org/generated/2.9.0/pdf/Ehcache_Replication_Guide.
MySQL远程连接(复制)
我有以下拓扑。一个 Ubuntu 16.04。运行我的全局 MySQL 服务器的 Amazon AWS 上的实例。我想将此服务器用作许多本地主服务器(Windows 机器 MySQL 服务器)的从服务
MySQL 复制
使用 SQLyog，我正在测试表中是否设置了正确的值。我尝试过 SELECT type_service FROM service WHERE email='test@gmail.com' 因此，只输出
Elasticsearch 复制
有人可以提供一些关于如何配置 ElasticSearch 进行复制的说明。我在 Windows 中运行 ES，并且了解如果我在同一台服务器上多次运行 bat 文件，则会启动一个单独的 ES 实例，并且
复制 Thread 数组
一点睛 ThreadGroup 复制线程的两个方法。 public int enumerate(Thread list[]) // 会将 ThreadGroup 中的 active 线程全部复制到
复制 ThreadGroup 数组
一点睛 ThreadGroup 复制线程组的两个方法。 public int enumerate(ThreadGroup list[]) // 相对于 enumerate（list,true） pu
添加新数据中心时用于系统模式的 Cassandra 复制
官方documentation Cassandra 说: Configure the keyspace and create the new datacenter: Use ALTER KEYSPAC
r - 如何在ggplot2中绘制加权黄土平滑度？ [复制]
This question already has answers here: How to weight smoothing by arbitrary factor in ggplot2? (2个答
excel - 复制/导出多列
我们有一个表格来表明对各种俱乐部的兴趣。输出将数据记录在 Excel 电子表格中，其中列有他们的首选姓名、姓氏、电子邮件、代词，以及他们感兴趣的俱乐部的相应列中的“1”(下面的模型)。我们希望为俱乐
vim - 如何使Vim带您回到上次编辑文件时的状态？ [复制]
This question already has answers here: Closed 8 years ago. Possible Duplicate: In vim, how do I get
vba - 复制/粘贴具有形状的单元格
如何复制形状及其所在的单元格？当我手动复制时，形状会跟随单元格，但是当我使用宏进行复制时，我会得到除形状之外的所有其他内容。 Cells(sourceRow, sourceColumn).Copy C

首页

博学

6Ren·AI

商城

c++ - 使用 CUDA 在 GPU 之间复制大数据