Microsoft MVP성태의 닷넷 이야기
VC++: 80. 내 컴퓨터에서 C++ AMP 코드가 실행이 될까요? [링크 복사], [링크+제목 복사],
조회: 24586
글쓴 사람
정성태 (techsharer at outlook.com)
홈페이지
첨부 파일
 

내 컴퓨터에서 C++ AMP 코드가 실행이 될까요?

공식 홈페이지를 보면,

C++ AMP Overview
; https://docs.microsoft.com/en-us/cpp/parallel/amp/cpp-amp-overview

시스템 요구 사항이 다음과 같이 나옵니다.

  • Windows 7, Windows 8, Windows Server 2008 R2, or Windows Server 2012
  • DirectX 11 Feature Level 11.0 or later hardware
  • For debugging on the software emulator, Windows 8 or Windows Server 2012 is required. For debugging on the hardware, you must install the drivers for your graphics card.

이런 거 보고 바로 알 수 있으면 좋겠지만 역시나 그냥 프로그램 돌려서 되냐 안되냐를 알 수 있는 것이 속편합니다. ^^ 이에 대해서는 다음의 글에 나오는 "VerifyAmpDevices" 유틸리티를 쓰시면 됩니다.

Can I Run C++ AMP on My Device?
; http://blogs.msdn.com/b/nativeconcurrency/archive/2011/09/22/can-i-run-c-amp-on-my-device.aspx

VerifyAmpDevices 유틸리티는 아래의 글에 포함된 list_all_accelerators() 함수를 이용해 쉽게 만들 수 있습니다.

Using accelerator and accelerator_view Objects
; https://docs.microsoft.com/en-us/cpp/parallel/amp/using-accelerator-and-accelerator-view-objects

뭐 대충 이런 식입니다.

#include "stdafx.h"

#include <amp.h>
#include <vector>
#include <amprt.h>

#include <iostream>

using namespace Concurrency;

// https://docs.microsoft.com/en-us/cpp/parallel/amp/using-accelerator-and-accelerator-view-objects
void list_all_accelerators();

int _tmain(int argc, _TCHAR* argv[])
{
    list_all_accelerators();

    return 0;
}

void list_all_accelerators()
{
    std::vector<accelerator> accs = accelerator::get_all();

    for (int i = 0; i < accs.size(); i++) {
        std::wcout << accs[i].device_path << ", desc = ";
        std::wcout << accs[i].description << ", has_display = ";
        std::wcout << accs[i].get_has_display() << ", is_emulated = ";
        std::wcout << accs[i].is_emulated << "\n";

        //std::wcout << accs[i].dedicated_memory << "\n";
        //std::wcout << (accs[i].supports_cpu_shared_memory ?
        //  "CPU shared memory: true" : "CPU shared memory: false") << "\n";
        //std::wcout << (accs[i].supports_double_precision ?
        //  "double precision: true" : "double precision: false") << "\n";
        //std::wcout << (accs[i].supports_limited_double_precision ?
        //  "limited double precision: true" : "limited double precision: false") << "\n\n";
    }
}

제 컴퓨터에서 위의 코드를 실행하면 다음과 같은 출력 결과가 나옵니다.

PCI\...[장치경로]..., desc = NVIDIA GeForce GTX 660  , has_display = 1, is_emulated = 0
direct3d\warp, desc = Microsoft Basic Render Driver, has_display = 0, is_emulated = 1
direct3d\ref, desc = Software Adapter, has_display = 1, is_emulated = 1
cpu, desc = CPU accelerator, has_display = 0, is_emulated = 1

당연히 is_emulated = 0인 값의 장치가 가장 성능이 우수할 것입니다. 또한 has_display는 현재 모니터 장치와 연결된 것을 의미한다고 하는데, direct3d\ref가 has_display = 1을 갖는 의미가 뭔지는 해석이 안되는군요. ^^

참고로, 중간의 warp와 ref에 대해서는 다음의 글에 약간의 설명이 나옵니다.

concurrency::accelerator 
; http://www.danielmoth.com/Blog/concurrencyaccelerator.aspx

  • accelerator::direct3d_ref represents the reference rasterizer emulator that simulates a direct3d device on the CPU (in a very slow manner). This emulator is available on systems with Visual Studio installed and is useful for debugging. More on debugging in general in future posts. Example: accelerator acc(accelerator::direct3d_ref);
  • accelerator::direct3d_warp represents WARP which is the current CPU fallback. Example: accelerator acc(accelerator::direct3d_warp);

ref는 Visual Studio가 설치된 경우에 있으며 디버깅이 쉽다는 장점이 있다고 하니, 그렇다면 일반적인 컴퓨터라면 GPU 하나와 direct3d\ref, cpu 정도만 AMP 장치로 검색될 것입니다.

아래의 글도 읽어보면 좋을 듯 싶군요. ^^

Server environments and C++ AMP
; http://blogs.msdn.com/b/nativeconcurrency/archive/2012/06/21/server-environments-and-c-amp.aspx





[이 글에 대해서 여러분들과 의견을 공유하고 싶습니다. 틀리거나 미흡한 부분 또는 의문 사항이 있으시면 언제든 댓글 남겨주십시오.]







[최초 등록일: ]
[최종 수정일: 7/17/2021]

Creative Commons License
이 저작물은 크리에이티브 커먼즈 코리아 저작자표시-비영리-변경금지 2.0 대한민국 라이센스에 따라 이용하실 수 있습니다.
by SeongTae Jeong, mailto:techsharer at outlook.com

비밀번호

댓글 작성자
 



2022-05-04 04시52분
VS2022부터 C++ AMP 공식 지원중단
; https://blog.naver.com/drvoss/222653027219
정성태

... 91  92  93  94  95  96  97  [98]  99  100  101  102  103  104  105  ...
NoWriterDateCnt.TitleFile(s)
11484정성태4/11/201824739.NET Framework: 737. C# - async를 Task 타입이 아닌 사용자 정의 타입에 적용하는 방법파일 다운로드1
11483정성태4/10/201828036개발 환경 구성: 358. "Let's Encrypt"에서 제공하는 무료 SSL 인증서를 IIS에 적용하는 방법 (2) [1]
11482정성태4/10/201820483VC++: 126. CUDA Core 수를 알아내는 방법
11481정성태4/10/201832102개발 환경 구성: 357. CUDA의 인덱싱 관련 용어 - blockIdx, threadIdx, blockDim, gridDim
11480정성태4/9/201822150.NET Framework: 736. C# - API를 사용해 Azure에 접근하는 방법 [2]파일 다운로드1
11479정성태4/9/201817763.NET Framework: 735. Azure - PowerShell로 Access control(IAM)에 새로운 계정 만드는 방법
11478정성태11/8/201920014디버깅 기술: 115. windbg - 덤프 파일로부터 PID와 환경변수 등의 정보를 구하는 방법 [1]
11477정성태4/8/201817464오류 유형: 460. windbg - sos 명령어 수행 시 c0000006 오류 발생
11476정성태4/8/201819028디버깅 기술: 114. windbg - !threads 출력 결과로부터 닷넷 관리 스레드(System.Threading.Thread) 객체를 구하는 방법
11475정성태3/28/201821325디버깅 기술: 113. windbg - Thread.Suspend 호출 시 응용 프로그램 hang 현상에 대한 덤프 분석
11474정성태3/27/201819441오류 유형: 459. xperf: error: TEST.Event: Invalid flags. (0x3ec).
11473정성태3/22/201824591.NET Framework: 734. C# - Thread.Suspend 호출 시 응용 프로그램 hang 현상파일 다운로드2
11472정성태3/22/201818561개발 환경 구성: 356. GTX 1070, GTX 960, GT 640M의 cudaGetDeviceProperties 출력 결과
11471정성태3/20/201821944VC++: 125. CUDA로 작성한 RGB2RGBA 성능 [1]파일 다운로드1
11470정성태3/20/201824102오류 유형: 458. Visual Studio - CUDA 프로젝트 빌드 시 오류 C1189, expression must have a constant value
11469정성태3/19/201817118오류 유형: 457. error MSB3103: Invalid Resx file. Could not load file or assembly 'System.Windows.Forms, ...' or one of its dependencies.
11468정성태3/19/201816647오류 유형: 456. 닷넷 응용 프로그램 실행 시 0x80131401 예외 발생
11467정성태3/19/201816083오류 유형: 455. Visual Studio Installer - 업데이트 실패
11466정성태3/18/201817230개발 환경 구성: 355. 한 대의 PC에서 2개 이상의 DirectX 게임을 실행하는 방법
11463정성태3/15/201819569.NET Framework: 733. 스레드 간의 read/write 시에도 lock이 필요 없는 경우파일 다운로드1
11462정성태3/14/201822431개발 환경 구성: 354. HTTPS 호출에 대한 TLS 설정 확인하는 방법 [1]
11461정성태3/13/201825057오류 유형: 454. 윈도우 업데이트 설치 오류 - 0x800705b4 [1]
11460정성태3/13/201817544디버깅 기술: 112. windbg - 닷넷 메모리 덤프에서 전역 객체의 내용을 조사하는 방법
11459정성태3/13/201818361오류 유형: 453. Debug Diagnostic Tool에서 mscordacwks.dll을 찾지 못하는 문제
11458정성태2/21/201819343오류 유형: 452. This share requires the obsolete SMB1 protocol, which is unsafe and could expose your system to attack. [1]
11457정성태2/17/201824056.NET Framework: 732. C# - Task.ContinueWith 설명 [1]파일 다운로드1
... 91  92  93  94  95  96  97  [98]  99  100  101  102  103  104  105  ...