Microsoft MVP성태의 닷넷 이야기
.NET Framework: 481. Mono 내부의 문자열 처리 방식은 UTF-8 [링크 복사], [링크+제목 복사],
조회: 22196
글쓴 사람
정성태 (techsharer at outlook.com)
홈페이지
첨부 파일
 

Mono 내부의 문자열 처리 방식은 UTF-8

지난번에 소개해 드린 모노 프로파일러로,

Visual Studio에서 Mono 용 Profiler 개발
; https://www.sysnet.pe.kr/2/0/1805

JIT 컴파일 시의 메서드 이름을 알아내는 코드를 다음과 같이 작성할 수 있습니다.

void mono_profiler_jit_compile_enter(MonoProfiler *prof, MonoMethod *method)
{
    const gchar *methodName = mono_method_get_name(method);
}

보시는 바와 같이 반환 값이 gchar *타입이고, gchar 타입은 GLib 헤더 파일에 char 타입으로 정의되어 있으므로 결국 wchar_t 처리에 대한 고려는 전혀 안되어 있습니다.

그렇다면, 한글 처리가 어떻게 될지 궁금해 지는데요. 이런 예제를 만들고,

using System;

class MainClass
{
    public static void Main (string[] args)
    {
        테스트 ();
    }

    public static void 테스트()
    {
        // ...
    }
}

프로파일러 코드에서 methodName을 구해 보면, Visual Studio의 Watch 창에는 "methodName 0x005604f8 <Invalid characters in string.> const char *"이라고 표시됩니다. 혹시나 싶어서 wchar_t * 타입으로 강제 형변환해도 깨진 글자로만 출력됩니다. Watch 창에 출력된 주소 "0x005604f8"의 메모리 값을 조사해 보면,

hangul_in_mono_1

보시는 바와 같이 "ed 85 8c ec 8a a4 ed 8a b8 00"으로 나옵니다. 대충 한글 한 글자당 3바이트가 할당되고 NULL 처리는 단일 '\0' 문자로만 되어 있는 걸로 봐서 UTF16 이상의 인코딩은 아닌 것 같고 UTF-8로 된 듯 한데, 다음과 같이 확인해 볼 수 있습니다.

using System;
using System.Text;

class Program
{
    static void Main(string[] args)
    {
        string txt = "테스트";
        Console.WriteLine(BitConverter.ToString(Encoding.UTF8.GetBytes(txt))); // 출력: ED-85-8C-EC-8A-A4-ED-8A-B8
    }
}

아하~~~ 맞군요. ^^

그렇다면 혹시 mono 런타임에 ANSI가 아닌 WIDE 타입의 문자열로 반환하는 메서드가 있지 않을까요? 미리 답변을 내리자면, 없습니다.

모노 소스코드의 "\mono\mono\metadata\class-internals.h" 헤더 파일에 보면 MonoMethod는 다음과 같이 정의되어 있습니다.
struct _MonoMethod {
    guint16 flags;  /* method flags */
    guint16 iflags; /* method implementation flags */
    guint32 token;
    MonoClass *klass;
    MonoMethodSignature *signature;
    const char *name;
    //...[생략]...
}

그리고 "\mono\mono\metadata\loader.c"에 정의된 mono_method_get_name은 그저 MonoMethod 클래스의 name 필드를 반환하는 역할만 합니다.

const char*
mono_method_get_name (MonoMethod *method)
{
    return method->name;
}

대신 GLib를 이용하면 다음과 같이 편하게 대응함수를 만들 수 있습니다.

wchar_t* mono_method_get_nameW(MonoMethod *method)
{
    const gchar *methodName = mono_method_get_name(method);

    wchar_t *pName = (wchar_t *)g_utf8_to_utf16(methodName, strlen(methodName), NULL, NULL, NULL);
    return pName; // mono_method_get_nameW에서는 반드시 g_free를 해야 함.
}

참고로, g_utf8_to_utf16 메서드는 내부적으로 g_malloc으로 메모리를 할당해서 UTF-16 인코딩의 문자열을 담은 버퍼를 반환하기 때문에 사용 후 반드시 g_free 메서드로 해제해야 합니다.

그런데... Mono의 전반적인 문자열 처리가 이렇게 1바이트 연산 기반의 utf-8로 되어 있기 때문에 가능한 그대로 따르는 것이 좋습니다. (예를 들어, strlen과 같은 문자열 연산 함수에서 별탈없이 성공하기 때문에.) 단지, 마지막에 출력할 때나 UTF16으로 변환하는 식의 처리만 하는 것이 코드 작성이 간결해 질 수 있습니다.

(그나저나, 요새 잠깐 시간날 때마다 Mono를 살펴보고 있는데... 과히 만족스럽진 않군요. ^^ 아무리 무료로 공개되어 자금 지원의 규모면에서 차이가 있다고는 하지만.)




[이 글에 대해서 여러분들과 의견을 공유하고 싶습니다. 틀리거나 미흡한 부분 또는 의문 사항이 있으시면 언제든 댓글 남겨주십시오.]







[최초 등록일: ]
[최종 수정일: 7/10/2021]

Creative Commons License
이 저작물은 크리에이티브 커먼즈 코리아 저작자표시-비영리-변경금지 2.0 대한민국 라이센스에 따라 이용하실 수 있습니다.
by SeongTae Jeong, mailto:techsharer at outlook.com

비밀번호

댓글 작성자
 




... [136]  137  138  139  140  141  142  143  144  145  146  147  148  149  150  ...
NoWriterDateCnt.TitleFile(s)
1687정성태6/15/201427855개발 환경 구성: 223. PowerShell로 Visual Studio 빌드 스크립트 작성파일 다운로드1
1686정성태6/12/201425895Windows: 96. 윈도우 8 - 그림 암호를 이용해 로그인 시 지연 현상을 해결하는 방법 [1]
1685정성태6/10/201432450.NET Framework: 443. 자바 8과 C#의 람다(Lambda) 지원에 대한 비교 [12]
1684정성태6/9/201442599.NET Framework: 442. C# - 시스템의 CPU 사용량 및 프로세스(EXE)의 CPU 사용량 알아내는 방법 [5]파일 다운로드1
1683정성태6/2/201422137오류 유형: 228. CLR4 보안 - yield 구문 내에서 SecurityCritical 메서드 사용 불가 [2]파일 다운로드1
1682정성태6/1/201427801.NET Framework: 441. .NET CLR4 보안 모델 - 3. CLR4 보안 모델에서의 APTCA 역할파일 다운로드2
1681정성태6/1/201423287.NET Framework: 440. .NET CLR4 보안 모델 - 2. 샌드박스(Sandbox)을 이용한 보안 [2]파일 다운로드1
1680정성태6/1/201422693.NET Framework: 439. .NET CLR4 보안 모델 - 1. "Security Level 2"란?파일 다운로드1
1679정성태5/31/201421784.NET Framework: 438. .NET CLR2 보안 모델에서의 APTCA 역할파일 다운로드1
1678정성태5/31/201425511개발 환경 구성: 222. 라이브러리 개발자를 위한 보안 권한 테스트 - "Network Service" 계정 권한으로 실행
1677정성태5/30/201421000VS.NET IDE: 87. IIS Express - 웹 응용 프로그램의 .NET 버전에 맞는 CLR이 로드되지 않는 경우파일 다운로드1
1676정성태5/27/201429337Windows: 95. 윈도우 8에서 Hyper-V 유무에 따른 듀얼 부트 설정하는 방법 [1]
1675정성태5/27/201431467Windows: 94. 윈도우 8.1에서 윈도우 체험 지수(Windows Experience Index, WEI) 확인 방법
1674정성태5/24/201425035VS.NET IDE: 86. 하나의 T4 템플릿으로 여러 개의 소스코드 파일을 자동으로 생성하는 방법 [1]파일 다운로드1
1673정성태5/19/201424551.NET Framework: 437. WACOM 태블릿 환경에서 WinForm 실행시 System.ArgumentException 예외 발생
1672정성태5/15/201425186기타: 46. Microsoft의 응용 프로그램을 클라우드로 제공하는 서비스 - Azure RemoteApp 소개 [2]
1671정성태5/15/201425806.NET Framework: 436. XNA Content 리소스의 해제 후 다시 로드해서 사용하면 ObjectDisposedException 예외 발생 [2]
1670정성태5/15/201425999.NET Framework: 435. .NET GC - 하위 세대의 객체를 포함하는 상위 세대의 참조를 추적하기 위한 card-table
1669정성태5/15/201446175Windows: 93. 윈도우 시스템 디스크 용량 확보를 위한 $PatchCache$ 폴더 삭제 [2]
1668정성태5/10/201425167.NET Framework: 434. Microsoft.SqlServer.Types.SqlGeography 형변환 시 null 반환하는 문제
1667정성태5/5/201426121개발 환경 구성: 221. Azure 데이터베이스를 로컬 DB로 이전하는 방법 [2]
1666정성태5/2/201442792기타: 45. 윈도우 계정의 암호를 알아내는 mimikatz 도구 [5]
1665정성태5/1/201426177.NET Framework: 433. C# - 간단한 HyperLogLog 자료 구조 테스트파일 다운로드1
1664정성태4/28/201423603오류 유형: 227. Process Explorer의 프로세스 뷰가 트리 형식으로 보이지 않는 문제
1663정성태4/28/201419992오류 유형: 226. Visual Studio - We were unable to establish the connection because it is configured for user
1662정성태4/28/201424600개발 환경 구성: 220. supportedRuntime 설정을 위한 app.config Transformation [1]
... [136]  137  138  139  140  141  142  143  144  145  146  147  148  149  150  ...