Microsoft MVP성태의 닷넷 이야기
글쓴 사람
정성태 (techsharer at outlook.com)
홈페이지
첨부 파일

제니퍼 닷넷 적용 사례 (5) - RestSharp 라이브러리의 CPU High 현상

고객사의 웹 사이트가 CPU High 현상으로 서비스가 일시적으로 불능 상태에 빠졌습니다. 평소에는 문제가 없었는데 특정 시간대에 갑자기 사용자가 몰리면서 문제가 표면으로 나타난 것입니다.

제니퍼 제품의 XView를 통해 보니 대략 다음과 같은 패턴으로 장애가 나타났는데요. (실제로는 이보다 더 심각했습니다.)

restsharp_poor_perf_1.png

위의 화면을 보면, 10초 시간 대에 빨간색 점으로 나타나는데 모두 자체적으로 정의된 10초 time-out에 걸려 오류가 발생한 것들입니다.

제니퍼 분석 결과, 해당 시간대에 CPU를 가장 많이 소비한 응용 프로그램이 밝혀졌고 이를 "test.aspx"라고 가정하겠습니다. 해당 페이지의 응답 기록을 보니 평소에도 2,000ms 정도가 걸렸고 특이하게도 그 응답 시간 동안 CPU 소비량이 1,800ms로 90% 정도가 CPU-intensive한 작업을 하고 있었습니다.

일단 범인은 밝혀졌으므로 이젠 관심사가 test.aspx 소스코드의 어떤 부분에서 잘못된 것인지로 옮겨갔습니다.

다행히, 해당 웹 애플리케이션 서비스 장애가 발생한 시점에 남겨진 "서비스 덤프"를 통해 쉽게 문제에 접근할 수 있었습니다. 지난번 사례에서도 "서비스 덤프"가 장애 원인을 밝히는 데 결정적인 역할을 했었는데... 이번에도 그랬습니다. ^^

제니퍼 닷넷 적용 사례 (2) - 웹 애플리케이션 hang 의 원인을 알려주다.
; https://www.sysnet.pe.kr/2/0/1117

이번 고객사의 서비스 덤프 내용을 보니, test.aspx 페이지의 경우 대부분 다음과 같이 RestSharp.Deserializers.JsonDeserializer, System.Text.RegularExpressions 쪽의 호출 스택을 갖고 있다는 것이었습니다.

D:192.168.0.5:20151005/134415:2153:52.0%:LA1:TXEXED:/test.aspx::WebReq.http://mytestsrv/test.asmx:::::-5268713217693983903::-5268713217693983903
   위치: System.Threading.Monitor.Enter(Object obj)
   위치: System.Text.RegularExpressions.Regex.LookupCachedAndUpdate(String key)
   위치: System.Text.RegularExpressions.Regex..ctor(String pattern, RegexOptions options, TimeSpan matchTimeout, Boolean useCache)
   위치: RestSharp.Extensions.StringExtensions.AddUnderscores(String pascalCasedWord)
   위치: RestSharp.Extensions.StringExtensions.<GetNameVariants>d__0.MoveNext()
   위치: System.Linq.Enumerable.Contains[TSource](IEnumerable`1 source, TSource value, IEqualityComparer`1 comparer)
   위치: System.Linq.Enumerable.FirstOrDefault[TSource](IEnumerable`1 source, Func`2 predicate)
   위치: RestSharp.Extensions.ReflectionExtensions.FindEnumValue(Type type, String value, CultureInfo culture)
   위치: RestSharp.Deserializers.JsonDeserializer.ConvertValue(Type type, Object value)
   위치: RestSharp.Deserializers.JsonDeserializer.Map(Object target, IDictionary`2 data)
   위치: RestSharp.Deserializers.JsonDeserializer.CreateAndMap(Type type, Object element)
   위치: RestSharp.Deserializers.JsonDeserializer.ConvertValue(Type type, Object value)
...[이하 생략]...

JSON 관련 직렬화(Serialization) 작업에 정규 표현식(Regular Expression)을 사용했다면 왠지 모르게 CPU 100% 현상의 주요 원인이었음을 짐작케 해줍니다.

이 사실을 고객 측과 공유했고 현재 관련 라이브러리를 제거하고 정상적인 서비스에 들어갔다고 합니다. ^^




회사로 복귀한 후, "하지만, 정말 그게 원인일까???" 하는 의문이 생겼습니다. 왜냐하면 콜스택에 남았다고 해서 CPU 소비량이 크다는 증거가 아니기 때문입니다. 하필 콜스택을 남기는 순간에 그것이 실행되었을 수도 있으므로 확실한 증거를 얻기 위해 간단하게 테스트 코드를 작성해 보았습니다.

이를 위해 WCF Restful 서비스를 하는 서버 측 코드를 작성하고,

using System;
using System.ServiceModel;
using System.ServiceModel.Web;

namespace ConsoleApplication2
{
    // http://blog.sublogic.com/2010/07/15/making-a-wcf-rest-stand-alone-service-exe-from-scratch-part-1-of-4-creating-the-minimal-bare-service/
    [ServiceContract]
    public class MyService
    {
        [WebGet(UriTemplate = "say/{something}")]
        public string AnswerBack(string something)
        {
            return "You said: " + something;
        }
    }

    class Program
    {
        static void Main(string[] args)
        {
            using (var serviceHost = new ServiceHost(typeof(MyService)))
            {
                serviceHost.Open();
                Console.WriteLine("Hit Enter when done");
                Console.ReadLine();
            }            
        }
    }
}

다른 컴퓨터에 띄워놓은 후 다음의 RestSharp 클라이언트 측 코드를 작성해 실행해 보았습니다.

using System;
using System.Net;
using System.Threading;

namespace ConsoleApplication1
{
    class Program
    {
        static int _count = 0;

        static void Main(string[] args)
        {
            System.Net.ServicePointManager.DefaultConnectionLimit = 40000;

            int loadCount = (int)(Environment.ProcessorCount * 1.5);

            CreateTest(loadCount, restThreadFunc);
            
            ThreadPool.QueueUserWorkItem(Printthroughput);

            Console.ReadLine();
        }

        private static void Printthroughput(object obj)
        {
            int old = 0;

            while (true)
            {
                Thread.Sleep(1000);

                int current = _count;
                int reqPerSecond = current - old;
                Console.WriteLine("Req / Second: " + reqPerSecond);

                old = current;
            }
        }

        private static void CreateTest(int threadCount, ThreadStart action)
        {
            for (int i = 0; i < threadCount; i ++)
            {
                Thread t = new Thread(action);
                t.IsBackground = true;
                t.Start();
            }
        }

        private static void restThreadFunc()
        {
            while (true)
            {
                RestSharp.RestClient client = new RestSharp.RestClient("http://192.168.0.6:8077");
                RestSharp.RestRequest request = new RestSharp.RestRequest("/testing/say/hello", RestSharp.Method.GET);

                string result = client.Execute(request).Content;
                Interlocked.Increment(ref _count);
            }
        }
    }
}

제 컴퓨터가 하이퍼스레딩이 활성화된 상태에서 8개의 논리 코어가 있어 12개의 스레드를 생성해 위의 코드를 실행했더니 다음과 같은 결과를 얻었습니다.

restsharp_poor_perf_2.png

보시는 것처럼, 초당 2,500 ~ 3,200 사이의 처리량을 보였고 아주 단순한 유형의 Restful API를 호출한 것인데도 CPU는 완전히 100%를 전부 쓰고 있습니다. 고객사에 이 상황을 대입해 보면 장애 상황이 이해가 갑니다. test.aspx의 처리에 1,800ms 동안의 CPU 사용량을 보였으니 8개의 코어가 있다고 가정했을 때 겨우 8명의 사용자가 해당 페이지를 동시에 호출하기만 해도 대략 2초 동안은 CPU 점유율이 100%를 치기 때문에 서비스 불능 상황이 발생했던 것입니다.

비교를 위해 RestSharp.RestClient 호출을 닷넷의 WebClient로 바꿔 보았는데요. 결과는 다음과 같습니다.

restsharp_poor_perf_3.png

CPU 사용량이 20%로 안정화되었고 처리량이 8,500 ~ 9,000 사이를 보입니다. (제가 테스트한 네트워크 상태가 안좋아서 그 이상 나오질 않았습니다.)




결론은? RestSharp 라이브러리는 가능한 "클라이언트 측 응용 프로그램"에서만 사용하는 것이 좋습니다. 서비스 유형의 응용 프로그램에서 이를 사용하는 것은 권장되지 않습니다.

(첨부한 파일은 제가 테스트한 서버/클라이언트 측 코드입니다.)




[이 글에 대해서 여러분들과 의견을 공유하고 싶습니다. 틀리거나 미흡한 부분 또는 의문 사항이 있으시면 언제든 댓글 남겨주십시오.]







[최초 등록일: ]
[최종 수정일: 6/27/2021]

Creative Commons License
이 저작물은 크리에이티브 커먼즈 코리아 저작자표시-비영리-변경금지 2.0 대한민국 라이센스에 따라 이용하실 수 있습니다.
by SeongTae Jeong, mailto:techsharer at outlook.com

비밀번호

댓글 작성자
 




... 61  62  63  64  65  66  67  68  69  70  71  [72]  73  74  75  ...
NoWriterDateCnt.TitleFile(s)
11826정성태2/26/201912102오류 유형: 520. 우분투에 .NET Core SDK 설치 시 패키지 의존성 오류
11825정성태2/25/201916939개발 환경 구성: 428. Visual Studio 2019 - CMake를 이용한 리눅스 빌드 환경 설정 [1]
11824정성태2/25/201911726오류 유형: 519. The SNMP Service encountered an error while accessing the registry key SYSTEM\CurrentControlSet\Services\SNMP\Parameters\TrapConfiguration. [1]
11823정성태2/21/201913155오류 유형: 518. IIS 관리 콘솔이 뜨지 않는 문제
11822정성태2/20/201911357오류 유형: 517. docker에 설치한 MongoDB 서버로 연결이 안 되는 경우
11821정성태2/20/201911832오류 유형: 516. Visual Studio 2019 - This extension uses deprecated APIs and is at risk of not functioning in a future VS update. [1]
11820정성태2/20/201914930오류 유형: 515. 윈도우 10 1809 업데이트 후 "User Profiles Service" 1534 경고 발생
11819정성태2/20/201913580Windows: 158. 컴퓨터와 사용자의 SID(security identifier) 확인 방법
11818정성태2/20/201912528VS.NET IDE: 131. Visual Studio 2019 Preview의 닷넷 프로젝트 빌드가 20초 이상 걸리는 경우 [2]
11817정성태2/17/20199752오류 유형: 514. WinDbg Preview 실행 오류 - Error : DbgX.dll : WindowsDebugger.WindowsDebuggerException: Could not load dbgeng.dll
11816정성태2/17/201912203Windows: 157. 윈도우 스토어 앱(Microsoft Store App)을 명령행에서 직접 실행하는 방법
11815정성태2/14/201911132오류 유형: 513. Visual Studio 2019 - VSIX 설치 시 "The extension cannot be installed to this product due to prerequisites that cannot be resolved." 오류 발생
11814정성태2/12/20199880오류 유형: 512. VM(가상 머신)의 NT 서비스들이 자동 시작되지 않는 문제
11813정성태2/12/201911476.NET Framework: 809. C# - ("Save File Dialog" 등의) 대화 창에 확장 속성을 보이는 방법
11812정성태2/11/20199408오류 유형: 511. Windows Server 2003 VM 부팅 후 로그인 시점에 0xC0000005 BSOD 발생
11811정성태2/11/201913109오류 유형: 510. 서버 운영체제에 NVIDIA GeForce Experience 실행 시 wlanapi.dll 누락 문제
11810정성태2/11/201911146.NET Framework: 808. .NET Profiler - GAC 모듈에서 GAC 비-등록 모듈을 참조하는 경우의 문제
11809정성태2/11/201912625.NET Framework: 807. ClrMD를 이용해 메모리 덤프 파일로부터 특정 인스턴스를 참조하고 있는 소유자 확인
11808정성태2/8/201913760디버깅 기술: 123. windbg - 닷넷 응용 프로그램의 메모리 누수 분석
11807정성태1/29/201912129Windows: 156. 가상 디스크의 용량을 복구 파티션으로 인해 늘리지 못하는 경우 [4]
11806정성태1/29/201911786디버깅 기술: 122. windbg - 덤프 파일로부터 PID와 환경 변수 등의 정보를 구하는 방법
11805정성태1/28/201913736.NET Framework: 806. C# - int []와 object []의 차이로 이해하는 제네릭의 필요성 [4]파일 다운로드1
11804정성태1/24/201911769Windows: 155. diskpart - remove letter 이후 재부팅 시 다시 드라이브 문자가 할당되는 경우
11803정성태1/10/201911247디버깅 기술: 121. windbg - 닷넷 Finalizer 스레드가 멈춰있는 현상
11802정성태1/7/201912644.NET Framework: 805. 두 개의 윈도우를 각각 실행하는 방법(Windows Forms, WPF)파일 다운로드1
11801정성태1/1/201913512개발 환경 구성: 427. Netsh의 네트워크 모니터링 기능 [3]
... 61  62  63  64  65  66  67  68  69  70  71  [72]  73  74  75  ...