성태의 닷넷 이야기
홈 주인
모아 놓은 자료
프로그래밍
질문/답변
사용자 관리
사용자
메뉴
아티클
외부 아티클
유용한 코드
온라인 기능
MathJax 입력기
최근 덧글
[정성태] How can I tell whether two programs...
[정성태] The case of the fail-fast crashes c...
[정성태] Creating Docker multi-arch images f...
[정성태] BinaryFormatter removed from .NET 9...
[정성태] Extending the Windows Shell Progres...
[우광현] 와..... 범위를 잡았으니 클라이언트가 해당 범위를 확인해본다...
[정성태] 딱히, 그것 이상으로 더 설명할 내용이 없습니다. 동적 포...
[정성태] If Windows 3.11 required a 32-bit p...
[정성태] What is a hard error, and what make...
[괴물신인] 질문작성자인데 이 글을 이제봤네요 ㄷㄷ 이 글처럼 타입별로 인...
글쓰기
제목
이름
암호
전자우편
HTML
홈페이지
유형
제니퍼 .NET
닷넷
COM 개체 관련
스크립트
VC++
VS.NET IDE
Windows
Team Foundation Server
디버깅 기술
오류 유형
개발 환경 구성
웹
기타
Linux
Java
DDK
Math
Phone
Graphics
사물인터넷
부모글 보이기/감추기
내용
<div style='display: inline'> <h1 style='font-family: Malgun Gothic, Consolas; font-size: 20pt; color: #006699; text-align: center; font-weight: bold'>C# 문자열의 인코딩이란?</h1> <p> 오늘 아는 분으로부터 뜻밖의 질문을 받아서... ^^ 음... 이런 것도 헷갈릴 수 있겠구나... 하는 생각이 들어 정리해 보았습니다.<br /> <br /> 일단, 그 분의 질문은 이런 것이었습니다.<br /> <br /> <div style='BACKGROUND-COLOR: #ccffcc; padding: 10px 10px 5px 10px; MARGIN: 0px 10px 10px 10px; FONT-FAMILY: Malgun Gothic, Consolas, Verdana; COLOR: #005555'> Java의 Netty 서버로 전송하는데, 당연히 Java 클라이언트는 잘 실행이 되지만 C#으로 만든 클라이언트는 한글만 들어가면 호출에 실패한다.<br /> </div><br /> <br /> 이런 경우... 대부분 인코딩 문제인데요. 그래서, Java 클라이언트와 C# 클라이언트를 각각 실행하고 그 순간의 통신을 <a target='tab' href='http://www.microsoft.com/en-us/download/details.aspx?id=4865'>Network Monitor</a>로 가로채서 한글이 있는 부분을 확인해 보라고 했습니다.<br /> <br /> 그 결과, "서울"이라는 문자열을 보낸 경우 각각 다음의 바이트 값들이 보였다고 합니다.<br /> <br /> <pre style='margin: 10px 0px 10px 10px; padding: 10px 0px 10px 10px; background-color: #fbedbb; overflow: auto; font-family: Consolas, Verdana;' > * Java EC 84 9c EC 9A B8 * C# BC AD BF EF </pre> <br /> 해보시면 알겠지만, Java의 결과는 UTF-8 인코딩 된 바이트 스트림이고, C#의 결과는 ks_c_5601-1987의 것입니다. 원인 파악이 되었으니 이제 다음과 같이 코딩을 해서 넘겨주면 되는 일이었습니다.<br /> <br /> <pre style='margin: 10px 0px 10px 10px; padding: 10px 0px 10px 10px; background-color: #fbedbb; overflow: auto; font-family: Consolas, Verdana;' > string txt = "서울"; byte [] contents = Encoding.UTF8.GetBytes(txt); // 이후, contents 배열을 Netty 서버에 전송 </pre> <br /> 그런데, 그 분이 즐겨 사용하던 Netty용 C# 라이브러리의 전송 API가 다음과 같이 문자열을 받는 것이었다고 합니다.<br /> <br /> <pre style='margin: 10px 0px 10px 10px; padding: 10px 0px 10px 10px; background-color: #fbedbb; overflow: auto; font-family: Consolas, Verdana;' > public class Netty { public static void Send(string txt); } </pre> <br /> 그래서... 전송을 아래와 같은 식으로 해버린 것이지요.<br /> <br /> <pre style='margin: 10px 0px 10px 10px; padding: 10px 0px 10px 10px; background-color: #fbedbb; overflow: auto; font-family: Consolas, Verdana;' > ===== 전에는 이렇게 했는데 ===== string txt = "서울"; Netty.Send(txt); ===== 인코딩을 위해 다음과 같이 변경 ===== string txt = "서울"; byte [] contents = <span style='color: blue; font-weight: bold'>Encoding.UTF8.GetBytes</span>(txt); string output = <span style='color: blue; font-weight: bold'>Encoding.UTF8.GetString</span>(contents); Netty.Send(output); // 다시 C# string 인스턴스를 인자로 제공 </pre> <br /> 문제는, ^^ 인코딩을 한 바이트 배열을 다시 string으로 변환했다고 해서 그것이 C# string의 메모리에 UTF-8로 저장되는 것은 아니라는 점입니다. 왜냐하면, C#은 string 인스턴스의 모든 바이트 배열을 무조건 UTF-16 LE 방식으로 인코딩시켜 메모리에 들고 있기 때문입니다. 즉, 모든 Encoding.GetString 메서드는 특정 인코딩 방식으로 변환된 바이트 배열을 UTF-16 LE 인코딩으로 다시 변환시키는 역할을 합니다.<br /> <br /> 위의 코드가 문제가 되는 이유는 결국 Netty.Send 메서드 내에서 다음과 같이 전송을 하기 때문입니다.<br /> <br /> <pre style='margin: 10px 0px 10px 10px; padding: 10px 0px 10px 10px; background-color: #fbedbb; overflow: auto; font-family: Consolas, Verdana;' > public static void Send(string txt) { byte [] encoded = Encoding.Default.GetBytes(txt); // 한글 윈도우의 경우, Default == ks_c_5601-1987 Socket.Send(encoded); } </pre> <br /> 이를 해결하기 위해서는 Netty 라이브러리가 인코딩 인자를 하나 더 받는 메서드를 제공해 주던가,<br /> <br /> <pre style='margin: 10px 0px 10px 10px; padding: 10px 0px 10px 10px; background-color: #fbedbb; overflow: auto; font-family: Consolas, Verdana;' > public static void Send(string txt, Encoding encoder) { byte [] encoded = encoder.GetBytes(txt); Socket.Send(encoded); } Netty.Send("서울", Encoding.UTF8); </pre> <br /> 아니면 직접 바이트 배열을 받는 메서드가 있어야 합니다.<br /> <br /> <pre style='margin: 10px 0px 10px 10px; padding: 10px 0px 10px 10px; background-color: #fbedbb; overflow: auto; font-family: Consolas, Verdana;' > public static void Send(byte [] buffer) { Socket.Send(buffer); } byte [] contents = Encoding.UTF8.GetBytes(txt); Netty.Send(contents); </pre> <br /> (2020-10-24 업데이트) 공식적이지는 않지만 이런 상황에서 다음의 우회 방법이 있습니다.<br /> <br /> <pre style='margin: 10px 0px 10px 10px; padding: 10px 0px 10px 10px; background-color: #fbedbb; overflow: auto; font-family: Consolas, Verdana;' > C# - Encoding.Default 값을 바꿀 수 있을까요? ; <a target='tab' href='https://www.sysnet.pe.kr/2/0/12037'>https://www.sysnet.pe.kr/2/0/12037</a> </pre> <br /> <hr style='width: 50%' /><br /> <br /> 참고로, 다음의 글을 보시면 더욱 도움이 되겠지요. ^^<br /> <br /> <pre style='margin: 10px 0px 10px 10px; padding: 10px 0px 10px 10px; background-color: #fbedbb; overflow: auto; font-family: Consolas, Verdana;' > 유니코드와 한글 - 유니코드와 닷넷을 이용한 한글 처리 ; <a target='tab' href='http://www.sysnet.pe.kr/2/0/1294'>http://www.sysnet.pe.kr/2/0/1294</a> </pre> </p><br /> <br /><hr /><span style='color: Maroon'>[이 글에 대해서 여러분들과 의견을 공유하고 싶습니다. 틀리거나 미흡한 부분 또는 의문 사항이 있으시면 언제든 댓글 남겨주십시오.]</span> </div>
첨부파일
스팸 방지용 인증 번호
4383
(왼쪽의 숫자를 입력해야 합니다.)