Microsoft MVP성태의 닷넷 이야기
.NET Framework: 756. JSON의 escape sequence 문자 처리 방식 [링크 복사], [링크+제목 복사]
조회: 14182
글쓴 사람
정성태 (techsharer at outlook.com)
홈페이지
첨부 파일
 
(연관된 글이 1개 있습니다.)

JSON의 escape sequence 문자 처리 방식

이번 글은 아래의 글을 재작성한 것입니다.

JSON.parse가 허용하지 않는 문자
; https://www.sysnet.pe.kr/2/0/11531




아래의 웹 페이지를 브라우저로 보면,

<!DOCTYPE html>

<html lang="en" xmlns="http://www.w3.org/1999/xhtml">
<head>
    <meta charset="utf-8" />
    <title></title>

    <script>
        function parse_input() {
            var txt = '{"firstname":"My\tName"}';
            var obj = JSON.parse(txt);
        }
    </script>

</head>
<body>
    <input type="button" onclick="parse_input()" value="test" />
</body>
</html>

F12 개발자 콘솔을 통해 parse_input 함수 수행 시 다음과 같은 오류가 나는 것을 볼 수 있습니다.

[Internet Explorer 11]

SCRIPT1014: Invalid character
encode_sample.html (15,13)

[Edge]

SCRIPT5655: SCRIPT5655: JSON.parse Error: Invalid character at position:17

[Chrome]

VM32:1 Uncaught SyntaxError: Unexpected token    in JSON at position 18
    at JSON.parse (<anonymous>)
    at parse_input (encode_sample.html:15)
    at HTMLInputElement.onclick (encode_sample.html:22)

원인은 json 텍스트에 포함된 탭(\t) 문자 때문입니다. JSON에서는 쉽게 말해 눈으로 확인할 수 있는 유형의 문자만 가능하므로 탭이나, 개행(\r, \n) 문자 등은 원본 바이트 그대로 허용하지 않습니다. 이러한 제어 문자들은, 그에 대한 표현은 이스케이프 시퀀스를 따르나 그것 자체도 '문자'로 담겨 있어야 합니다. 예를 들어, 탭의 경우 '\t' 바이트로 문자열 내에 있지만 JSON 파서에 인식시키려면 "\\t" 문자열로, 즉 '\\', 't' 문자들의 연속으로 포함하고 있어야 합니다. 따라서 다음과 같은 식의 전처리를 해줘야 합니다.

var txt = '{"firstname":"My\tName\n"}';
var replacedText = txt.replace(/\t/g, "\\t")
                     .replace(/\n/g, "\\n");
                 
var obj = JSON.parse(replacedText);

마찬가지로 JSON으로 직렬화했을 때에도, 즉 JSON.stringify 메서드의 결과물에는 탭 문자가 '\t'로 존재하지 않고 '\\', 't'로 나타나게 됩니다.

정리해 보면, "\\t" 문자열을 JSON으로 역직렬화하면 '\t' 문자로 변환이 됩니다. 버퍼에 보관된 '\t' 문자는 다시 JSON 직렬화를 하면 "\\t" 문자열로 됩니다.




그런데, JSON.NET과 같은 라이브러리들은 제어 문자에 대해 '\t', "\\t"에 상관없이 역직렬화를 해 줍니다.

using System;

namespace ConsoleApp1
{
    class Program
    {
        static void Main(string[] args)
        {
            string txt = "{\"firstname\":\"test\tqwer\"}";
            dynamic result = Newtonsoft.Json.JsonConvert.DeserializeObject(txt);
            Console.WriteLine(result.firstname);
        }
    }
}

/*
출력 결과:

test    qwer
*/

반면 직렬화를 할 때는 '\t' 문자를 원래의 JSON 포맷에 맞게 "\\t"로 바꿔줍니다. 따라서 JSON.NET으로 역직렬화 후 직렬화를 한 경우 원본과 다른 문자열이 생성될 수 있습니다.

string txt = "{\"firstname\":\"test\tqwer\"}";

dynamic result = Newtonsoft.Json.JsonConvert.DeserializeObject(txt);
string txt2 = Newtonsoft.Json.JsonConvert.SerializeObject(result);

Console.WriteLine(txt); // 원본 문자열 출력
Console.WriteLine(txt2); // 역직렬화 -> 직렬화 문자열

/*
출력 결과

{"firstname":"test     qwer"}
{"firstname":"test\tqwer"}
*/

비록 전처리를 위한 단계를 생략할 수 있어 성능은 개선할 수 있지만, 대칭의 아름다움이 없어지니! ^^




[이 글에 대해서 여러분들과 의견을 공유하고 싶습니다. 틀리거나 미흡한 부분 또는 의문 사항이 있으시면 언제든 댓글 남겨주십시오.]

[연관 글]






[최초 등록일: ]
[최종 수정일: 6/5/2018]

Creative Commons License
이 저작물은 크리에이티브 커먼즈 코리아 저작자표시-비영리-변경금지 2.0 대한민국 라이센스에 따라 이용하실 수 있습니다.
by SeongTae Jeong, mailto:techsharer at outlook.com

비밀번호

댓글 작성자
 




1  2  [3]  4  5  6  7  8  9  10  11  12  13  14  15  ...
NoWriterDateCnt.TitleFile(s)
13560정성태2/19/20242056디버깅 기술: 195. windbg 분석 사례 - Semaphore 잠금으로 인한 Hang 현상 (닷넷)
13559정성태2/19/20242937오류 유형: 895. ASP.NET - System.Security.SecurityException: 'Requested registry access is not allowed.'
13558정성태2/18/20242161닷넷: 2217. C# - 최댓값이 1인 SemaphoreSlim 보다 Mutex 또는 lock(obj)를 선택하는 것이 나은 이유
13557정성태2/18/20241913Windows: 258. Task Scheduler의 Author 속성 값을 변경하는 방법
13556정성태2/17/20241956Windows: 257. Windows - Symbolic (hard/soft) Link 및 Junction 차이점
13555정성태2/15/20242112닷넷: 2216. C# - SemaphoreSlim 사용 시 주의점
13554정성태2/15/20241856VS.NET IDE: 189. Visual Studio - 닷넷 소스코드 디컴파일 찾기가 안 될 때
13553정성태2/14/20241938닷넷: 2215. windbg - thin/fat lock 없이 동작하는 Monitor.Wait + Pulse
13552정성태2/13/20241887닷넷: 2214. windbg - Monitor.Enter의 thin lock과 fat lock
13551정성태2/12/20242084닷넷: 2213. ASP.NET/Core 웹 응용 프로그램 - 2차 스레드의 예외로 인한 비정상 종료
13550정성태2/11/20242198Windows: 256. C# - Server socket이 닫히면 Accept 시켰던 자식 소켓이 닫힐까요?
13549정성태2/3/20242500개발 환경 구성: 706. C# - 컨테이너에서 실행하기 위한 (소켓) 콘솔 프로젝트 구성
13548정성태2/1/20242330개발 환경 구성: 705. "Docker Desktop for Windows" - ASP.NET Core 응용 프로그램의 소켓 주소 바인딩(IPv4/IPv6 loopback, Any)
13547정성태1/31/20242084개발 환경 구성: 704. Visual Studio - .NET 8 프로젝트부터 dockerfile에 추가된 "USER app" 설정
13546정성태1/30/20241941Windows: 255. (디버거의 영향 등으로) 대상 프로세스가 멈추면 Socket KeepAlive로 연결이 끊길까요?
13545정성태1/30/20241858닷넷: 2212. ASP.NET Core - 우선순위에 따른 HTTP/HTTPS 호스트:포트 바인딩 방법
13544정성태1/30/20241882오류 유형: 894. Microsoft.Data.SqlClient - Could not load file or assembly 'System.Security.Permissions, ...'
13543정성태1/30/20241880Windows: 254. Windows - 기본 사용 중인 5357 포트 비활성화는 방법
13542정성태1/30/20241912오류 유형: 893. Visual Studio - Web Application을 실행하지 못하는 IISExpress - 두 번째 이야기
13541정성태1/29/20241954VS.NET IDE: 188. launchSettings.json의 useSSL 옵션
13540정성태1/29/20242075Linux: 69. 리눅스 - "Docker Desktop for Windows" Container 환경에서 IPv6 Loopback Address 바인딩 오류
13539정성태1/26/20242364개발 환경 구성: 703. Visual Studio - launchSettings.json을 이용한 HTTP/HTTPS 포트 바인딩
13538정성태1/25/20242415닷넷: 2211. C# - NonGC(FOH) 영역에 .NET 개체를 생성파일 다운로드1
13537정성태1/24/20242500닷넷: 2210. C# - Native 메모리에 .NET 개체를 생성파일 다운로드1
13536정성태1/23/20242587닷넷: 2209. .NET 8 - NonGC Heap / FOH (Frozen Object Heap) [1]
13535정성태1/22/20242431닷넷: 2208. C# - GCHandle 구조체의 메모리 분석
1  2  [3]  4  5  6  7  8  9  10  11  12  13  14  15  ...