- c - 在位数组中找到第一个零
- linux - Unix 显示有关匹配两种模式之一的文件的信息
- 正则表达式替换多个文件
- linux - 隐藏来自 xtrace 的命令
我有一个奇怪的问题,我无法解决。它与 boost +推力代码相关联。
代码:
#include <boost/config/compiler/nvcc.hpp>
#include <thrust/host_vector.h>
#include <thrust/device_vector.h>
#include <thrust/sort.h>
#include <thrust/copy.h>
#include <thrust/sequence.h>
#include <thrust/random.h>
#include <thrust/generate.h>
#include <thrust/detail/type_traits.h>
#include <cuda_runtime.h>
#include <cublas_v2.h>
#include <common/inc/helper_cuda.h>
#include <boost/numeric/ublas/matrix.hpp>
#include <boost/numeric/ublas/operation.hpp>
#include <boost/random/mersenne_twister.hpp>
#include <boost/random/uniform_int_distribution.hpp>
#include <boost/compute/system.hpp>
#include <boost/compute/command_queue.hpp>
#include <boost/compute/algorithm/generate.hpp>
#include <boost/compute/algorithm/generate_n.hpp>
#include <algorithm>
#include <time.h>
#include <limits.h>
#include <algorithm>
using namespace boost::numeric::ublas;
using namespace boost::random;
using namespace boost::compute;
int main(int argc, char **argv)
{
int N = 100000;
unbounded_array<float> lineMatrix1(N*N);
unbounded_array<float> lineMatrix2(N*N);
generate_n(lineMatrix1.begin(), N*N, []() { return (10 * rand() / RAND_MAX); });
generate_n(lineMatrix2.begin(), N*N, []() { return (10 * rand() / RAND_MAX); });
matrix<float> matrix1(N, N, lineMatrix1);
matrix<float> matrix2(N, N, lineMatrix2);
matrix<float> zeroMatrix(N, N, 0);
matrix<float> zeroMatrix2(N, N, 0);
//boost single core computation start
auto matrix3 = prod(matrix1, matrix2);
//boost single core computation finish
//thrust computation start
findCudaDevice(argc, (const char **)argv);
cublasHandle_t handle;
cublasCreate(&handle);
float alpha = 1.0f;
float beta = 0.0f;
auto result = cublasSgemm(handle, CUBLAS_OP_N, CUBLAS_OP_N, N, N, N, &alpha, matrix1.data().cbegin(), N, matrix2.data().cbegin(), N, &beta, zeroMatrix.data().begin(), N);
cudaDeviceSynchronize();
thrust::device_vector<float> deviceMatrix1(N*N);
thrust::device_vector<float> deviceMatrix2(N*N);
thrust::device_vector<float> deviceZeroMatrix(N*N, 0);
thrust::copy(matrix1.data().cbegin(), matrix1.data().cend(), deviceMatrix1.begin());
thrust::copy(matrix2.data().cbegin(), matrix2.data().cend(), deviceMatrix2.begin());
auto result2 = cublasSgemm(handle, CUBLAS_OP_N, CUBLAS_OP_N, N, N, N, &alpha, deviceMatrix1.data().get(), N, deviceMatrix2.data().get(), N, &beta, deviceZeroMatrix.data().get(), N);
cudaDeviceSynchronize();
thrust::copy(deviceZeroMatrix.cbegin(), deviceZeroMatrix.cend(), zeroMatrix2.data().begin());
std::cout << result << std::endl;
std::cout << result2 << std::endl;
//thrust computation finish
float eps = 0.00001;
int differCount1 = 0;
int differCount2 = 0;
for (int i = 0; i < matrix3.size1(); i++)
{
for (int j = 0; j < matrix3.size2(); j++)
{
if (std::abs(matrix3(i, j) != zeroMatrix(i, j)) > eps)
differCount1++;
if (std::abs(matrix3(i, j) != zeroMatrix2(i, j)) > eps)
differCount2++;
}
}
std::cout << differCount1 << std::endl;
std::cout << differCount2 << std::endl;
char c;
std::cin >> c;
return 0;
}
此文件的名称为“myFirstMatrixTest.cu”。
所以,我有编译器错误:
MSB3721 exit from command ""C:\Program Files\NVIDIA GPU Computing Toolkit\CUDA\v9.2\bin\nvcc.exe" -gencode=arch=compute_30,code=\"sm_30,compute_30\" -gencode=arch=compute_35,code=\"sm_35,compute_35\" -gencode=arch=compute_37,code=\"sm_37,compute_37\" -gencode=arch=compute_50,code=\"sm_50,compute_50\" -gencode=arch=compute_52,code=\"sm_52,compute_52\" -gencode=arch=compute_60,code=\"sm_60,compute_60\" -gencode=arch=compute_61,code=\"sm_61,compute_61\" -gencode=arch=compute_70,code=\"sm_70,compute_70\" --use-local-env -ccbin "C:\Program Files (x86)\Microsoft Visual Studio\2017\Community\VC\Tools\MSVC\14.14.26428\bin\HostX86\x64" -x cu -rdc=true -I./ -I../common/inc -I../../common/inc -I/common/inc -I../ -I./ -I"C:\Program Files\NVIDIA GPU Computing Toolkit\CUDA\v9.2/include" -I../../common/inc -I"C:\Program Files\NVIDIA GPU Computing Toolkit\CUDA\v9.2\include" -G --keep-dir x64\Debug -maxrregcount=0 --machine 64 --compile -cudart static -Xcompiler "/wd 4819" -g -DWIN32 -DWIN32 -D_MBCS -D_MBCS -Xcompiler "/EHsc /W3 /nologo /Od /FS /Zi /RTC1 /MTd " -o x64/Debug/MyFirstMatrixTest.cu.obj "C:\User Root\Repository\CUDA Projects\MatrixMultiplicationThrust\MyFirstMatrixTest.cu"" with code "2". MyFirstMatrixTest C:\Program Files (x86)\Microsoft Visual Studio\2017\Community\Common7\IDE\VC\VCTargets\BuildCustomizations\CUDA 9.2.targets 707
还有这个:
Fatal Error C1012 unmatched parenthesis : missing character ")" MyFirstMatrixTest c:\local\boost\preprocessor\slot\detail\shared.hpp 27
为什么会出现这个错误?
谢谢。
最佳答案
嗯,第一个问题是
int N = 100000;
所以 N^2 = 10,000,000,000...(永远不会适合 int
)。即 10G*4 字节( float )= 40 GBytes 的数据。对我来说,这会引发内存异常。
我遇到的下一个问题是 unbounded_array
和 generate_n
的组合。只是没有用。但是由于您使用的是 Thrust,因此请使用 Thrust 类型和算法(我不确定为什么 Thrust 有自己的类型来替换 STL,但无论如何)。
我在 2015 模式下使用 Visual Studio 2017 v15.7(否则我会收到不受支持的错误)与 Cuda v9.2 和 Boost 1.67.0。
我修改了你的代码,直到它能正确编译:(注意随机发生器仿函数中的更正,它首先只生成整数并将它们转换为 float )
#include <boost/config/compiler/nvcc.hpp>
#include <thrust/host_vector.h>
#include <thrust/device_vector.h>
#include <thrust/copy.h>
#include <thrust/generate.h>
#include <thrust/inner_product.h>
#include <cuda_runtime.h>
#include <cublas_v2.h>
#pragma comment(lib,"cublas.lib")
#include <helper_cuda.h>
#include <boost/numeric/ublas/matrix.hpp>
//#include <boost/numeric/ublas/io.hpp>
using boost::numeric::ublas::matrix;
#include <random>
int main(int argc, char **argv)
{
constexpr size_t N = 100;
constexpr size_t NN = N * N;
thrust::host_vector<float> lineMatrix1; lineMatrix1.reserve(NN);
thrust::host_vector<float> lineMatrix2; lineMatrix2.reserve(NN);
{
std::random_device rd; //Will be used to obtain a seed for the random number engine
std::mt19937 gen(rd()); //Standard mersenne_twister_engine seeded with rd()
std::uniform_real_distribution<float> dis(0.0f, 10.0f);
auto genRnd = [&]() { return dis(gen); };
thrust::generate_n(std::back_inserter(lineMatrix1), NN, genRnd);
thrust::generate_n(std::back_inserter(lineMatrix2), NN, genRnd);
}
matrix<float> matrix1(N, N);
thrust::copy_n(std::cbegin(lineMatrix1), NN, std::begin(matrix1.begin1()));
//std::cout << "Matrix 1:\n" << matrix1 << std::endl;
matrix<float> matrix2(N, N);
thrust::copy_n(std::cbegin(lineMatrix2), NN, std::begin(matrix2.begin1()));
//std::cout << "Matrix 2:\n" << matrix2 << std::endl;
//auto matrix3 = prod(matrix1, matrix2);
auto matrix3 = trans(prod(trans(matrix1), trans(matrix2)));
//std::cout << "Matrix 3:\n" << matrix3 << std::endl;
thrust::host_vector<float> hostResult; hostResult.reserve(NN);
for (auto rowIt = matrix3.cbegin1(); rowIt != matrix3.cend1(); rowIt++)
for (const auto& element : rowIt)
hostResult.push_back(element);
std::cout << "Host Result:\n";
for (const auto& el : hostResult) std::cout << el << " ";
std::cout << std::endl;
//////boost single core computation finish
//////thrust computation start
findCudaDevice(argc, (const char **)argv);
cublasHandle_t handle;
cublasCreate(&handle);
const float alpha = 1.0f;
const float beta = 0.0f;
thrust::device_vector<float> deviceMatrix1; deviceMatrix1.reserve(NN);
thrust::copy_n(std::cbegin(lineMatrix1), NN, std::back_inserter(deviceMatrix1));
thrust::device_vector<float> deviceMatrix2; deviceMatrix2.reserve(NN);
thrust::copy_n(std::cbegin(lineMatrix2), NN, std::back_inserter(deviceMatrix2));
thrust::device_vector<float> deviceZeroMatrix(NN,0);
auto result2 = cublasSgemm(handle,
CUBLAS_OP_N, CUBLAS_OP_N, N, N, N,
&alpha,
deviceMatrix1.data().get(), N,
deviceMatrix2.data().get(), N,
&beta,
deviceZeroMatrix.data().get(), N);
cudaDeviceSynchronize();
cublasDestroy(handle);
thrust::host_vector<float> deviceResult; deviceResult.reserve(NN);
thrust::copy_n(std::cbegin(deviceZeroMatrix), NN, std::back_inserter(deviceResult));
std::cout << "Device Result:\n";
for (const auto& el : deviceResult) std::cout << el << " ";
std::cout << std::endl;
//////thrust computation finish
auto accError = thrust::inner_product(std::cbegin(hostResult), std::cend(hostResult), std::cbegin(deviceResult), 0.0f, std::plus<float>(),
[](auto val1, auto val2) { return std::abs(val1 - val2); });
std::cout << "Accumulated error: " << accError << std::endl;
std::cout << "Average error: " << accError/NN << std::endl;
std::cin.ignore();
return 0;
}
编辑:修复了代码。 ublas 矩阵存储的矩阵不同于 vector ,因此我不得不转置矩阵和结果。此外,事实证明很难将 ublas 矩阵复制回 vector 。
edit2:编译参数
"C:\Program Files\NVIDIA GPU Computing Toolkit\CUDA\v9.2\bin\nvcc.exe" -gencode=arch=compute_30,code=\"sm_30,compute_30\" --use-local-env -ccbin "C:\Program Files (x86)\Microsoft Visual Studio 14.0\VC\bin\x86_amd64" -x cu -I"C:\Program Files\NVIDIA GPU Computing Toolkit\CUDA\v9.2\include" -I"C:\Program Files\NVIDIA GPU Computing Toolkit\CUDA\v9.2\include" -G --keep-dir x64\Debug -maxrregcount=0 --machine 64 --compile -cudart static -g -DWIN32 -DWIN64 -D_DEBUG -D_CONSOLE -D_MBCS -Xcompiler "/EHsc /W3 /nologo /Od /FS /Zi /RTC1 /MDd " -o x64\Debug\kernel.cu.obj "C:\Cpp\Cuda\SoHelp2\kernel.cu"
关于c++ - Thrust+boost代码编译错误,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/50877647/
我已经使用 vue-cli 两个星期了,直到今天一切正常。我在本地建立这个项目。 https://drive.google.com/open?id=0BwGw1zyyKjW7S3RYWXRaX24tQ
您好,我正在尝试使用 python 库 pytesseract 从图像中提取文本。请找到代码: from PIL import Image from pytesseract import image_
我的错误 /usr/bin/ld: errno: TLS definition in /lib/libc.so.6 section .tbss mismatches non-TLS reference
我已经训练了一个模型,我正在尝试使用 predict函数但它返回以下错误。 Error in contrasts<-(*tmp*, value = contr.funs[1 + isOF[nn]])
根据Microsoft DataConnectors的信息我想通过 this ODBC driver 创建一个从 PowerBi 到 PostgreSQL 的连接器使用直接查询。我重用了 Micros
我已经为 SoundManagement 创建了一个包,其中有一个扩展 MediaPlayer 的类。我希望全局控制这个变量。这是我的代码: package soundmanagement; impo
我在Heroku上部署了一个应用程序。我正在使用免费服务。 我经常收到以下错误消息。 PG::Error: ERROR: out of memory 如果刷新浏览器,就可以了。但是随后,它又随机发生
我正在运行 LAMP 服务器,这个 .htaccess 给我一个 500 错误。其作用是过滤关键字并重定向到相应的域名。 Options +FollowSymLinks RewriteEngine
我有两个驱动器 A 和 B。使用 python 脚本,我在“A”驱动器中创建一些文件,并运行 powerscript,该脚本以 1 秒的间隔将驱动器 A 中的所有文件复制到驱动器 B。 我在 powe
下面的函数一直返回这个错误信息。我认为可能是 double_precision 字段类型导致了这种情况,我尝试使用 CAST,但要么不是这样,要么我没有做对...帮助? 这是错误: ERROR: i
这个问题已经有答案了: Syntax error due to using a reserved word as a table or column name in MySQL (1 个回答) 已关闭
我的数据库有这个小问题。 我创建了一个表“articoli”,其中包含商品的品牌、型号和价格。 每篇文章都由一个 id (ID_ARTICOLO)` 定义,它是一个自动递增字段。 好吧,现在当我尝试插
我是新来的。我目前正在 DeVry 在线学习中级 C++ 编程。我们正在使用 C++ Primer Plus 这本书,到目前为止我一直做得很好。我的老师最近向我们扔了一个曲线球。我目前的任务是这样的:
这个问题在这里已经有了答案: What is an undefined reference/unresolved external symbol error and how do I fix it?
我的网站中有一段代码有问题;此错误仅发生在 Internet Explorer 7 中。 我没有在这里发布我所有的 HTML/CSS 标记,而是发布了网站的一个版本 here . 如您所见,我在列中有
如果尝试在 USB 设备上构建 node.js 应用程序时在我的树莓派上使用 npm 时遇到一些问题。 package.json 看起来像这样: { "name" : "node-todo",
在 Python 中,您有 None单例,在某些情况下表现得很奇怪: >>> a = None >>> type(a) >>> isinstance(a,None) Traceback (most
这是我的 build.gradle (Module:app) 文件: apply plugin: 'com.android.application' android { compileSdkV
我是 android 的新手,我的项目刚才编译和运行正常,但在我尝试实现抽屉导航后,它给了我这个错误 FAILURE: Build failed with an exception. What wen
谁能解释一下?我想我正在做一些非常愚蠢的事情,并且急切地等待着启蒙。 我得到这个输出: phpversion() == 7.2.25-1+0~20191128.32+debian8~1.gbp108
我是一名优秀的程序员,十分优秀!