WindowsVista 64bit+VS2008配置CUDA环境

2024-04-14 14:08

本文主要是介绍WindowsVista 64bit+VS2008配置CUDA环境,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

 

1、  软件准备

1.1   cudadriver_2.3_winvista_64_190.38_general

1.2   cudatoolkit_2.3_win_64

1.3   cudasdk_2.3_win_64

1.4   VS2008

安装前将之前安装的sdktoolkitdriver等卸载,再依次安装上述软件。如果开发平台没有支持CUDA的显卡,则不需要安装cudadriver_2.3_winvista_64_190.38_general

 

2、  安装检查

2.1 cmd下执行nvcc –V可以查看当前版本号

    nvcc: NVIDIA (R) Cuda compiler driver                                           

       Copyright (c) 2005-2009 NVIDIA Corporation                                     

       Built on Mon_Aug__3_19:43:55_PDT_2009                                      

       Cuda compilation tools, release 2.3, V0.2.1221                                     

2.2 执行bandwidthtest查看配置是否正常

       进入/ProgramData/NVIDIA Corporation/NVIDIA GPU Computing SDK/C/bin/win64/Release>目录,执行

       ./bandwidthTest.exe --memory=pinned --mode=range --start=10240000 --end=10240000 -increment=10240000

       若正常会有类似信息

Running on......                                                                                   

      device 0:Quadro FX 580                                                            

Range Mode                                                                                   

Host to Device Bandwidth for Pinned memory                                                             

Transfer Size (Bytes)   Bandwidth(MB/s)                                                            

 10240000               5101.1                                                            

Range Mode                                                                                    

Device to Host Bandwidth for Pinned memory                                                            

Transfer Size (Bytes)   Bandwidth(MB/s)                                                             

 10240000               4650.8                                                            

Range Mode                                                                                   

Device to Device Bandwidth                                                             

Transfer Size (Bytes)   Bandwidth(MB/s)                                                            

 10240000               14812.5                                                            

&&&& Test PASSED                                                              

Press ENTER to exit...                                                            

2.3 执行deviceQuery.exe查看显卡具体型号

       ./ deviceQuery.exe

       若正常会有类似信息

CUDA Device Query (Runtime API) version (CUDART static linking)                       

There is 1 device supporting CUDA                                                     

Device 0: "Quadro FX 580"                                                           

  CUDA Driver Version:                           2.30                                  

  CUDA Runtime Version:                          2.30                             

  CUDA Capability Major revision number:         1                                            

  CUDA Capability Minor revision number:         1                                            

  Total amount of global memory:                 536870912 bytes                             

  Number of multiprocessors:                     4                                       

  Number of cores:                               32                             

  Total amount of constant memory:               65536 bytes                             

  Total amount of shared memory per block:       16384 bytes                             

  Total number of registers available per block: 8192                                         

  Warp size:                                     32                             

  Maximum number of threads per block:           512                                     

  Maximum sizes of each dimension of a block:    512 x 512 x 64                             

  Maximum sizes of each dimension of a grid:     65535 x 65535 x 1                             

  Maximum memory pitch:                          262144 bytes                        

  Texture alignment:                             256 bytes                             

  Clock rate:                                    1.13 GHz                             

  Concurrent copy and execution:                 Yes                                      

  Run time limit on kernels:                     No                                     

  Integrated:                                    No                             

  Support host page-locked memory mapping:       No                                       

  Compute mode:                                  Default (multiple host threads can        use this device simultaneously)                                                            

Test PASSED                                                                          

Press ENTER to exit...                                                                    

       根据信息可以推算显卡的单精度浮点处理性能为3*32*1.13=108.48Gflops

 

3、  设置系统环境变量

3.1 将安装的CUDAsdk的路径加到系统环境变量中:

例如C:/ProgramData/NVIDIA Corporation/NVIDIA GPU Computing SDK/C/bin/win64

下的

├─Debug

├─EmuDebug

└─EmuRelease

几个目录都加入到系统环境变量PATH中,这样才能在运行程序的时候找到相应的dll库。

3.2 将编译需要的头文件放到vs2008环境中

复制C:/ProgramData/NVIDIA Corporation/NVIDIA GPU Computing SDK/C/common目录到C:/Users/dawning/Documents/Visual Studio 2008

 

4、  VS2008建立CUDA简单的工程

4.1 将模板项目C:/ProgramData/NVIDIA Corporation/NVIDIA GPU Computing SDK/C/src/ template拷贝到vs2008项目目录C:/Users/dawning/Documents/Visual Studio 2008/Projects

4.2 打开vs2008,打开模板项目template_vc90

4.3 右键点击template.cu选择自定义编译选项%

这篇关于WindowsVista 64bit+VS2008配置CUDA环境的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/903189

相关文章

通过Docker容器部署Python环境的全流程

《通过Docker容器部署Python环境的全流程》在现代化开发流程中,Docker因其轻量化、环境隔离和跨平台一致性的特性,已成为部署Python应用的标准工具,本文将详细演示如何通过Docker容... 目录引言一、docker与python的协同优势二、核心步骤详解三、进阶配置技巧四、生产环境最佳实践

mybatis映射器配置小结

《mybatis映射器配置小结》本文详解MyBatis映射器配置,重点讲解字段映射的三种解决方案(别名、自动驼峰映射、resultMap),文中通过示例代码介绍的非常详细,对大家的学习或者工作具有一定... 目录select中字段的映射问题使用SQL语句中的别名功能使用mapUnderscoreToCame

Linux下MySQL数据库定时备份脚本与Crontab配置教学

《Linux下MySQL数据库定时备份脚本与Crontab配置教学》在生产环境中,数据库是核心资产之一,定期备份数据库可以有效防止意外数据丢失,本文将分享一份MySQL定时备份脚本,并讲解如何通过cr... 目录备份脚本详解脚本功能说明授权与可执行权限使用 Crontab 定时执行编辑 Crontab添加定

Java使用jar命令配置服务器端口的完整指南

《Java使用jar命令配置服务器端口的完整指南》本文将详细介绍如何使用java-jar命令启动应用,并重点讲解如何配置服务器端口,同时提供一个实用的Web工具来简化这一过程,希望对大家有所帮助... 目录1. Java Jar文件简介1.1 什么是Jar文件1.2 创建可执行Jar文件2. 使用java

SpringBoot 多环境开发实战(从配置、管理与控制)

《SpringBoot多环境开发实战(从配置、管理与控制)》本文详解SpringBoot多环境配置,涵盖单文件YAML、多文件模式、MavenProfile分组及激活策略,通过优先级控制灵活切换环境... 目录一、多环境开发基础(单文件 YAML 版)(一)配置原理与优势(二)实操示例二、多环境开发多文件版

Vite 打包目录结构自定义配置小结

《Vite打包目录结构自定义配置小结》在Vite工程开发中,默认打包后的dist目录资源常集中在asset目录下,不利于资源管理,本文基于Rollup配置原理,本文就来介绍一下通过Vite配置自定义... 目录一、实现原理二、具体配置步骤1. 基础配置文件2. 配置说明(1)js 资源分离(2)非 JS 资

使用docker搭建嵌入式Linux开发环境

《使用docker搭建嵌入式Linux开发环境》本文主要介绍了使用docker搭建嵌入式Linux开发环境,文中通过示例代码介绍的非常详细,对大家的学习或者工作具有一定的参考学习价值,需要的朋友们下面... 目录1、前言2、安装docker3、编写容器管理脚本4、创建容器1、前言在日常开发全志、rk等不同

MySQL8 密码强度评估与配置详解

《MySQL8密码强度评估与配置详解》MySQL8默认启用密码强度插件,实施MEDIUM策略(长度8、含数字/字母/特殊字符),支持动态调整与配置文件设置,推荐使用STRONG策略并定期更新密码以提... 目录一、mysql 8 密码强度评估机制1.核心插件:validate_password2.密码策略级

ShardingProxy读写分离之原理、配置与实践过程

《ShardingProxy读写分离之原理、配置与实践过程》ShardingProxy是ApacheShardingSphere的数据库中间件,通过三层架构实现读写分离,解决高并发场景下数据库性能瓶... 目录一、ShardingProxy技术定位与读写分离核心价值1.1 技术定位1.2 读写分离核心价值二

QT Creator配置Kit的实现示例

《QTCreator配置Kit的实现示例》本文主要介绍了使用Qt5.12.12与VS2022时,因MSVC编译器版本不匹配及WindowsSDK缺失导致配置错误的问题解决,感兴趣的可以了解一下... 目录0、背景:qt5.12.12+vs2022一、症状:二、原因:(可以跳过,直奔后面的解决方法)三、解决方