Microsoft MVP성태의 닷넷 이야기
C/C++: 164. Visual C++ - InterlockedCompareExchange128 사용 방법 [링크 복사], [링크+제목 복사],
조회: 10324
글쓴 사람
정성태 (techsharer at outlook.com)
홈페이지
첨부 파일
 
(연관된 글이 1개 있습니다.)

Visual C++ - InterlockedCompareExchange128 사용 방법

윈도우 개발 문서에서 볼 수 있는 InterlockedCompareExchange128 함수는,

InterlockedCompareExchange128 function (winnt.h)
; https://learn.microsoft.com/en-us/windows/win32/api/winnt/nf-winnt-interlockedcompareexchange128

사실 Visual C++ 내에서 Compiler Intrinsic으로 구현했기 때문에,

_InterlockedCompareExchange128 intrinsic functions
; https://learn.microsoft.com/en-us/cpp/intrinsics/interlockedcompareexchange128

일반적인 Win32 DLL과 무관하게 사용할 수 있습니다. 대충 예제는 다음과 같이 구현할 수 있는데요,

#include <windows.h>
#include <iostream>

typedef struct _LARGE_INTEGER_128 {
    __int64 Int[2];
} LARGE_INTEGER_128, * PLARGE_INTEGER_128;

int main()
{
    LARGE_INTEGER_128 value = { 0, 0 };

    LARGE_INTEGER_128 newValue = { 1, 0 };

    LARGE_INTEGER_128 comparand = { 0, 0 };

    BOOLEAN result = InterlockedCompareExchange128((LONG64*)&value,
        newValue.Int[1], newValue.Int[0], (LONG64*)&comparand);
    if (result == TRUE)
    {
        std::cout << "a = " << value.Int[1] << "," << value.Int[0] << std::endl;
    }

    return 0;
}

그런데, 위의 예제를 실행해 보면 (아마도 확률적으로, 제 경우에는 100%) 비정상 종료를 하게 될 것입니다. 또는, Visual Studio 디버거 내에서 실행하면 이런 오류를 만나게 될 텐데요,

Exception thrown: read access violation.
value.**Int** was 0xFFFFFFFFFFFFFFFF.

이에 대한 단서를 문서에서 찾을 수 있습니다.

The parameters for this function must be aligned on a 16-byte boundary; otherwise, the function will behave unpredictably on x64 systems. See _aligned_malloc.


실제로 문제가 발생했을 때의 value 변수 또는 comparand의 주소를 보면 이런 식일 것입니다. (이후 테스트 결과로 보면, comparand는 8바이트 정렬 주소여도 문제가 없습니다.)

+       value   {Int=0x000000a39abaf918 {0, 0} }    _LARGE_INTEGER_128
+       comparand   {Int=0x000000a39abaf978 {0, 0} }    _LARGE_INTEGER_128

즉, 8바이트 정렬을 하고 있는 것입니다. 이를 해결하기 위해서는 명시적으로 16바이트 정렬을 하라고 지정하는 방법이 있습니다.

typedef struct _LARGE_INTEGER_128 {
    __declspec(align(16)) __int64 Int[2];
} LARGE_INTEGER_128, * PLARGE_INTEGER_128;

이후 정상적으로 실행하는 것을 확인할 수 있습니다.




한 가지 재미있는 점은, Visual Studio 편집기에서 해당 변수에 대해 다음과 같은 경고를 보여준다는 점입니다.

cmp_exch_aligned_1.png

C28113: Accessing a local variable value via an interlocked function: This is an unusual usage which could be reconsidered.

로컬 변수를 사용하는 것이 부적절할 수 있다는 것인데요, 문서를 보면 Device Driver 환경에 대한 경고로 보이는 메시지를 담고 있는데, 그럼에도 로컬 변수가 아닌 전역 변수로 바꿔보면 비정상 종료를 하지 않게 됩니다.

LARGE_INTEGER_128 g_value = { 0, 0 };

int main()
{
    // ...[생략]...

    BOOLEAN result = InterlockedCompareExchange128((LONG64*)&g_value,
        newValue.Int[1], newValue.Int[0], (LONG64*)&comparand);
    // ...[생략]...

    return 0;
}

그리고 이때의 주소를 보면,

+       g_value {Int=0x00007ff663e9e1b0 {0, 0} }    _LARGE_INTEGER_128

당연하게도 16바이트 정렬이 된 위치에 변수가 있습니다. Visual C++ 컴파일러는 이것을 언제나 보장하는 것일까요? (혹시 아시는 분은 덧글 부탁드립니다.) 그래도 은근히 걱정되니 ^^ 저라면 __declspec(align(16)) 옵션을 꼭 지정할 것 같습니다.




참고로, 전역 변수의 경우 일부러 8바이트 정렬로 만들어 테스트를 해보면,

typedef struct _LARGE_INTEGER_128 {
    __int64 Int[4]; // 넉넉하게 잡고
} LARGE_INTEGER_128, * PLARGE_INTEGER_128;

// g_value == 전역 변수
LONG64* ptr = (LONG64*)(((BYTE*)&g_value) + 8); // 뒤로 8바이트를 밀어 16바이트 정렬을 깬 다음

// ...[생략]...

BOOLEAN result = InterlockedCompareExchange128(ptr,
    newValue.Int[1], newValue.Int[0], (LONG64*)&comparand);

예상한 대로 비정상 종료가 됩니다. 또한, 반대로 로컬 변수를 사용한 경우 일부러 16바이트 정렬을 시켜 테스트를 하면,

typedef struct _LARGE_INTEGER_128 {
    __int64 Int[4]; // 넉넉하게 잡고
} LARGE_INTEGER_128, * PLARGE_INTEGER_128;

LARGE_INTEGER_128 value = { 0, 0 }; // 로컬 변수

// ...[생략]...

LONG64* ptr = (LONG64*)(((BYTE*)&value) + 8); // 뒤로 8바이트를 밀어 일부러 16바이트로 정렬

BOOLEAN result = InterlockedCompareExchange128(ptr,
    newValue.Int[1], newValue.Int[0], (LONG64*)&comparand);

정상적으로 실행이 됩니다. 결국, 첫 번째 인자만 128비트 정렬을 만족하면 해당 함수는 정상적으로 동작합니다.




마치기 전에 테스트할 것이 하나 더 생각나는군요. ^^ InterlockedCompareExchange64의 경우 (요즘의 컴퓨터에서) 로컬 변수로 해도 저런 align 문제는 없습니다. 예를 들어, 다음과 같이 일부러 align을 4바이트 경계로 바꿔도,

#include <windows.h>
#include <iostream>

int main()
{
    __int64 value[2] = { 0, 0 };
    __int64 *ptr = (__int64*)(((BYTE*)value) + 4); // 4바이트 경계로 이동

    __int64 newValue = 1;

    __int64 comperand = 0;

    __int64 result = InterlockedCompareExchange64(ptr, newValue, comperand);
    std::cout << "result = " << result << ", value == " << value[0] << ", " << value[1] << std::endl; // 출력 결과: result = 0, value == 4294967296, 0

    return 0;
}

crash 없이 정상적으로 실행이 됩니다. 문서에 보면,

The variables for this function must be aligned on a 64-bit boundary; otherwise, this function will behave unpredictably on multiprocessor x86 systems and any non-x86 systems. See _aligned_malloc.


64비트 경계가 지켜져야 한다고는 하지만, (x64가 아닌) 32비트 시스템인 x86인 경우에만 문제가 된다고 나옵니다. (요즘에는 재현하기조차 힘든 상황이 되었습니다.)




[이 글에 대해서 여러분들과 의견을 공유하고 싶습니다. 틀리거나 미흡한 부분 또는 의문 사항이 있으시면 언제든 댓글 남겨주십시오.]

[연관 글]






[최초 등록일: ]
[최종 수정일: 12/5/2023]

Creative Commons License
이 저작물은 크리에이티브 커먼즈 코리아 저작자표시-비영리-변경금지 2.0 대한민국 라이센스에 따라 이용하실 수 있습니다.
by SeongTae Jeong, mailto:techsharer at outlook.com

비밀번호

댓글 작성자
 




... 61  62  63  64  65  66  67  68  69  70  71  72  [73]  74  75  ...
NoWriterDateCnt.TitleFile(s)
12111정성태1/12/202020620디버깅 기술: 155. C# - KernelMemoryIO 드라이버를 이용해 실행 프로그램을 숨기는 방법(DKOM: Direct Kernel Object Modification) [16]파일 다운로드1
12110정성태1/11/202019988디버깅 기술: 154. Patch Guard로 인해 블루 스크린(BSOD)가 발생하는 사례 [5]파일 다운로드1
12109정성태1/10/202016669오류 유형: 588. Driver 프로젝트 빌드 오류 - Inf2Cat error -2: "Inf2Cat, signability test failed."
12108정성태1/10/202017492오류 유형: 587. Kernel Driver 시작 시 127(The specified procedure could not be found.) 오류 메시지 발생
12107정성태1/10/202018694.NET Framework: 877. C# - 프로세스의 모든 핸들을 열람 - 두 번째 이야기
12106정성태1/8/202019702VC++: 136. C++ - OSR Driver Loader와 같은 Legacy 커널 드라이버 설치 프로그램 제작 [1]
12105정성태1/8/202018200디버깅 기술: 153. C# - PEB를 조작해 로드된 DLL을 숨기는 방법
12104정성태1/7/202019446DDK: 9. 커널 메모리를 읽고 쓰는 NT Legacy driver와 C# 클라이언트 프로그램 [4]
12103정성태1/7/202022566DDK: 8. Visual Studio 2019 + WDK Legacy Driver 제작- Hello World 예제 [1]파일 다운로드2
12102정성태1/6/202018848디버깅 기술: 152. User 권한(Ring 3)의 프로그램에서 _ETHREAD 주소(및 커널 메모리를 읽을 수 있다면 _EPROCESS 주소) 구하는 방법
12101정성태1/5/202019225.NET Framework: 876. C# - PEB(Process Environment Block)를 통해 로드된 모듈 목록 열람
12100정성태1/3/202016633.NET Framework: 875. .NET 3.5 이하에서 IntPtr.Add 사용
12099정성태1/3/202019492디버깅 기술: 151. Windows 10 - Process Explorer로 확인한 Handle 정보를 windbg에서 조회 [1]
12098정성태1/2/202019300.NET Framework: 874. C# - 커널 구조체의 Offset 값을 하드 코딩하지 않고 사용하는 방법 [3]
12097정성태1/2/202017401디버깅 기술: 150. windbg - Wow64, x86, x64에서의 커널 구조체(예: TEB) 구조체 확인
12096정성태12/30/201919985디버깅 기술: 149. C# - DbgEng.dll을 이용한 간단한 디버거 제작 [1]
12095정성태12/27/201921728VC++: 135. C++ - string_view의 동작 방식
12094정성태12/26/201919411.NET Framework: 873. C# - 코드를 통해 PDB 심벌 파일 다운로드 방법
12093정성태12/26/201919014.NET Framework: 872. C# - 로딩된 Native DLL의 export 함수 목록 출력파일 다운로드1
12092정성태12/25/201917702디버깅 기술: 148. cdb.exe를 이용해 (ntdll.dll 등에 정의된) 커널 구조체 출력하는 방법
12091정성태12/25/201920084디버깅 기술: 147. pdb 파일을 다운로드하기 위한 symchk.exe 실행에 필요한 최소 파일 [1]
12090정성태12/24/201920148.NET Framework: 871. .NET AnyCPU로 빌드된 PE 헤더의 로딩 전/후 차이점 [1]파일 다운로드1
12089정성태12/23/201919095디버깅 기술: 146. gflags와 _CrtIsMemoryBlock을 이용한 Heap 메모리 손상 여부 체크
12088정성태12/23/201918068Linux: 28. Linux - 윈도우의 "Run as different user" 기능을 shell에서 실행하는 방법
12087정성태12/21/201918565디버깅 기술: 145. windbg/sos - Dictionary의 entries 배열 내용을 모두 덤프하는 방법 (do_hashtable.py) [1]
12086정성태12/20/201921097디버깅 기술: 144. windbg - Marshal.FreeHGlobal에서 발생한 덤프 분석 사례
... 61  62  63  64  65  66  67  68  69  70  71  72  [73]  74  75  ...