Microsoft MVP성태의 닷넷 이야기
닷넷: 2258. C# - double (배정도 실수) 저장소의 비트 구조 [링크 복사], [링크+제목 복사],
조회: 8836
글쓴 사람
정성태 (techsharer at outlook.com)
홈페이지
첨부 파일

(시리즈 글이 8개 있습니다.)
.NET Framework: 539. C# - 부동 소수 계산 왜 이렇게 나오죠? (1)
; https://www.sysnet.pe.kr/2/0/10872

.NET Framework: 540. C# - 부동 소수 계산 왜 이렇게 나오죠? (2)
; https://www.sysnet.pe.kr/2/0/10873

.NET Framework: 608. double 값을 구할 때는 반드시 피연산자를 double로 형변환!
; https://www.sysnet.pe.kr/2/0/11055

개발 환경 구성: 440. C#, C++ - double의 Infinity, NaN 표현 방식
; https://www.sysnet.pe.kr/2/0/11896

기타: 85. 단정도/배정도 부동 소수점의 정밀도(Precision)에 따른 형변환 손실
; https://www.sysnet.pe.kr/2/0/13212

닷넷: 2257. C# - float (단정도 실수) 저장소의 비트 구조
; https://www.sysnet.pe.kr/2/0/13617

닷넷: 2258. C# - double (배정도 실수) 저장소의 비트 구조
; https://www.sysnet.pe.kr/2/0/13618

닷넷: 2259. C# - decimal 저장소의 비트 구조
; https://www.sysnet.pe.kr/2/0/13619




C# - double (배정도 실수) 저장소의 비트 구조

double의 경우 지난 글에서 다룬 float 방식과 거의 같습니다.

C# - float (단정도 실수) 저장소의 비트 구조
; https://www.sysnet.pe.kr/2/0/13617

단지, 지수부와 가수부를 위한 비트 수만 좀 더 확장한 유형인데요, 다음의 그림에 따라,

[배정도 실수 - 그림 출처: https://en.wikipedia.org/wiki/Double-precision_floating-point_format]
single_float_2.png

비트 구조만 맞춰서 masking만 잘하면 됩니다.

static unsafe void Main(string[] args)
{
    double d = -118.625;
    Console.WriteLine($"{d} (decimal: {(decimal)d}): sizeof(double): {sizeof(double)}");
    Console.WriteLine();

    byte* pDouble = (byte*)&d;
    PrintDoubleFormat(pDouble);
}

private static unsafe void PrintDoubleFormat(byte* pDouble)
{
    ulong data = *(ulong*)pDouble;

    ulong signBitMask = 0b_1000_0000_0000_0000_0000_0000_0000_0000_0000_0000_0000_0000_0000_0000_0000_0000;
    ulong exponentMask = 0b_0111_1111_1111_0000_0000_0000_0000_0000_0000_0000_0000_0000_0000_0000_0000_0000;
    ulong fractionMask = 0b_0000_0000_0000_1111_1111_1111_1111_1111_1111_1111_1111_1111_1111_1111_1111_1111;

    ulong signBit = (data & signBitMask);
    ulong exponentBits = (data & exponentMask);
    ulong fractionBits = (data & fractionMask);

    Console.WriteLine("signBit: \t" + Convert.ToString((long)signBit, 2).PadLeft(64, '0').Separator(4, '_'));
    Console.WriteLine("exponentBits: \t" + Convert.ToString((long)exponentBits, 2).PadLeft(64, '0').Separator(4, '_'));
    Console.WriteLine("fractionBits: \t" + Convert.ToString((long)fractionBits, 2).PadLeft(64, '0').Separator(4, '_'));
}

실행하면 다음과 같은 결과가 나오는데요,

-118.625 (decimal: -118.625): sizeof(double): 8

signBit:        1000_0000_0000_0000_0000_0000_0000_0000_0000_0000_0000_0000_0000_0000_0000_0000
exponentBits:   0100_0000_0101_0000_0000_0000_0000_0000_0000_0000_0000_0000_0000_0000_0000_0000
fractionBits:   0000_0000_0000_1101_1010_1000_0000_0000_0000_0000_0000_0000_0000_0000_0000_0000

IEEE 754 표준에 따른 정규화 과정을 거쳐,

2진수 변환)
-118.625 ==> 1110110.101

지수 표현)
1110110.101 ==> 1.110110101 * 26
    지수부: 6
    가수부: 1.110110101

double의 경우 float와는 달리 exponentBits가 11비트로 늘었는데요, 따라서 0 ~ 2,047의 수를 표현할 수 있으니 bias 값이 1,023이 됩니다. 결국 지수부 6에 (float는 127을 더했지만) 1023을 더한 1029 값이 exponentBits(100 0000 0101)로 설정됩니다.

가수부의 처리도 비트만 52비트로 늘었을 뿐 float에서의 처리와 다르지 않습니다.




분해된 정보로부터 원래의 double 값을 복원하는 것도 float에서의 규칙과 같습니다. 가수부의 110110101에서 생략된 가장 상위의 1을 복원시키고,

1_1011_0101 ==> 11_1011_0101

그다음, 지수부의 1029를 원래의 지수로 만들어줍니다. (반대로 1023을 빼면 됩니다.)

6 = 1029 - 1023

이렇게 구한 값들을 통해 처음의 double 값으로 복원할 수 있습니다.

1.110110101 * 2E6

==> 1110110.101

10진수로 ==> 118.625

==> sign 비트 적용
-118.625

이 과정 역시 float의 코드를 조금만 바꾸면 double로 이렇게 만들 수 있고,

{
    bool minus = signBit != 0;
    ulong exponents = exponentBits >> 52;

    // 삭제된 1을 복원하고,
    ulong fractions = fractionBits | 0b_0000_0000_0001_0000_0000_0000_0000_0000_0000_0000_0000_0000_0000_0000_0000_0000;

    int shift = (int)exponents - 1023;

    // (삭제된 1로 인해 12비트가 아닌) 11비트만 shift 시키면 원래의 가수로 변환
    fractions = fractions << 11;
    string mantissa = Convert.ToString((long)fractions, 2).TrimEnd('0');
    Console.WriteLine($"{(minus ? "-" : "")}{mantissa} * 2E{shift}");

    mantissa = Convert.ToString((long)fractions, 2).TrimEnd('0');
    mantissa = MarkDecimalPoint(mantissa, shift);
    Console.WriteLine($"{(minus ? "-" : "")}{mantissa}");

    decimal value = Recomposite(mantissa) * (minus ? -1 : 1);
    Console.WriteLine($"{value}, (double: {(double)value})");
}

// ... 기타 코드는 float 예제와 동일 ...

이전 코드와 합쳐서 실행해 보면 이런 결과를 얻을 수 있습니다.

-118.625 (decimal: -118.625): sizeof(double): 8

signBit:        1000_0000_0000_0000_0000_0000_0000_0000_0000_0000_0000_0000_0000_0000_0000_0000
exponentBits:   0100_0000_0101_0000_0000_0000_0000_0000_0000_0000_0000_0000_0000_0000_0000_0000
fractionBits:   0000_0000_0000_1101_1010_1000_0000_0000_0000_0000_0000_0000_0000_0000_0000_0000

-1110110101 * 2E6
-1110110.101
-118.625, (double: -118.625)

(첨부 파일은 이 글의 예제 코드를 포함합니다.)




참고로, NaN과 infinity 처리도 있는데 이에 대해서는 전에 설명한 적이 있습니다.

C#, C++ - double의 Infinity, NaN 표현 방식
; https://www.sysnet.pe.kr/2/0/11896

그런데 저렇게 장황하게 설명한 것보다 아래의 글에 도표로 잘 정리된 것이 있군요. ^^

Binary floating point and .NET
; https://csharpindepth.com/Articles/FloatingPoint

float_nan_infinity_1.png




[이 글에 대해서 여러분들과 의견을 공유하고 싶습니다. 틀리거나 미흡한 부분 또는 의문 사항이 있으시면 언제든 댓글 남겨주십시오.]







[최초 등록일: ]
[최종 수정일: 5/10/2024]

Creative Commons License
이 저작물은 크리에이티브 커먼즈 코리아 저작자표시-비영리-변경금지 2.0 대한민국 라이센스에 따라 이용하실 수 있습니다.
by SeongTae Jeong, mailto:techsharer at outlook.com

비밀번호

댓글 작성자
 




... 151  152  153  [154]  155  156  157  158  159  160  161  162  163  164  165  ...
NoWriterDateCnt.TitleFile(s)
1203정성태12/21/201125583제니퍼 .NET: 18. MEF가 적용된 ASP.NET 웹 사이트를 제니퍼 닷넷으로 모니터링 해본 결과! [6]
1202정성태12/21/201126077오류 유형: 144. The database '...' cannot be opened because it is version 661.
1201정성태12/14/201141125디버깅 기술: 47. .NET Reflector를 이용한 "소스 코드가 없는" 어셈블리 디버깅 [4]
1200정성태12/11/201126963디버깅 기술: 46. Windbg 확장 DLL 만들기 (2) - Debugger Extension API 사용파일 다운로드1
1199정성태12/11/201128374VC++: 55. JNI DLL 컴파일 시 x86과 x64의 Export된 함수의 이름이 왜 다를까요? [2]파일 다운로드1
1198정성태12/9/201132192디버깅 기술: 45. Windbg 확장 DLL 만들기 (1) - 스레드를 강제 종료시키는 명령어 [2]파일 다운로드1
1197정성태12/9/201129965.NET Framework: 282. Shader 강좌와 함께 배워보는 XNA Framework (2) - RenderMonkey의 Shader/Model 파일 연동파일 다운로드2
1196정성태12/9/201133147.NET Framework: 281. Shader 강좌와 함께 배워보는 XNA Framework (1) - 기초 프로그램 구조 [3]파일 다운로드2
1195정성태12/8/201147800오류 유형: 143. DXSDK_Jun10.exe 설치 시 "Error Code: S1023" 오류 해결하는 방법 [4]
1194정성태12/8/201135575개발 환경 구성: 137. Visual C++ 런타임 구성요소에 대한 디버그 버전 설치하는 방법
1193정성태12/8/201122624오류 유형: 142. Windows Phone SDK 7.1 설치 시 Expression Blend 제거를 요구하는 경우
1192정성태12/8/201125649개발 환경 구성: 136. Windows 7 SP1의 IIS에서 사용자 프로파일을 로드하는 방법
1191정성태12/6/201126818.NET Framework: 280. MVC3에서 JavaScriptSerializer 재정의하는 방법파일 다운로드1
1190정성태12/6/201129969오류 유형: 141. Visual C++ 컴파일 오류 - error C2275: 'xxxxx' : illegal use of this type as an expression [1]
1189정성태12/6/201137057VS.NET IDE: 70. Visual Studio에서 프로젝트 로드가 안된다면?
1188정성태12/3/201126155개발 환경 구성: 135. 마이크로소프트 TFS 호스팅 서비스 - Preview [3]
1187정성태12/2/201130813개발 환경 구성: 134. Robocopy 오류 및 종료 코드
1186정성태12/1/201132671.NET Framework: 279. WPF - 그리기 성능 및 Blurring 문제파일 다운로드1
1185정성태11/29/201123402.NET Framework: 278. WPF - Content의 Changed 이벤트에 해당하는게 뭔가요?파일 다운로드1
1184정성태11/29/201126202.NET Framework: 277. F#과 WPF가 어울리지 못하는 근본적인 이유 [2]
1183정성태11/26/201121708오류 유형: 140. Visual Studio 2010 - Floating된 에디트 윈도우가 사라지지 않는 경우 [2]
1182정성태11/25/201157432.NET Framework: 276. 중복 없는 숫자를 랜덤으로 배열하는 방법 [5]파일 다운로드1
1181정성태11/24/201127918디버깅 기술: 44. windbg의 mscordacwks DLL 로드 문제
1180정성태11/23/201137703.NET Framework: 275. 레지스트리 등록 및 Interop DLL 없이 COM 개체 사용하는 방법 [2]파일 다운로드1
1179정성태11/22/201128289.NET Framework: 274. ReaderWriterLockSlim은 언제 쓰는 걸까요? [4]파일 다운로드1
1178정성태11/19/201124796.NET Framework: 273. 설치된 .NET 버전에 민감한 코드를 포함하는 경우, 다중으로 어셈블리를 만들어야 할까요?파일 다운로드1
... 151  152  153  [154]  155  156  157  158  159  160  161  162  163  164  165  ...