Microsoft MVP성태의 닷넷 이야기
글쓴 사람
정성태 (techsharer at outlook.com)
홈페이지
첨부 파일
 

NT 서비스의 Main 메서드 안에서 Process.GetProcessesByName 호출 시 멈춤 현상

일반적으로 NT 서비스는 다음과 같은 식으로 만듭니다.

public class Service1 : System.ServiceProcess.ServiceBase
{
    static void Main()
    {
        System.ServiceProcess.ServiceBase[] ServicesToRun = 
            new System.ServiceProcess.ServiceBase[] { new Service1() };

        System.ServiceProcess.ServiceBase.Run(ServicesToRun);
    }

    private void InitializeComponent()
    {
        this.ServiceName = "Service1";
    }

    protected override void OnStart(string[] args)
    {
        // 서비스 코드 작성 (예를 들어, WCF Open)
    }
 
    protected override void OnStop()
    {
    }
}

그런데, 제 경우에 Main 메서드에서 ServiceBase.Run을 호출하기 전에 약간의 초기화 작업이 필요해서 다음과 같은 코드를 넣었습니다.

Process[] processes = Process.GetProcesses(...); 
[또는]
Process[] processes = Process.GetProcessesByName(...);

이렇게 놓고 테스트를 하는데, 5대의 VM 중에서 4대에서는 정상적으로 되고 1대에서만 Process.GetProcessesByName에서 스레드가 블록되어 버리고, SCM(Service Control Manager)은 일정 시간 동안 NT 서비스가 실행을 반환하지 않으므로 중간에 서비스를 강제 종료해버렸습니다.

Windows Server 2003 x86 SP2(.NET 2.0 ~ .NET 4.0 설치): 정상 동작
Windows Server 2003 x64 SP2(.NET 2.0 ~ .NET 4.0 설치): 정상 동작
Windows Server 2008 x86 SP2(.NET 2.0 ~ .NET 4.0 설치): 정상 동작
Windows Server 2008 R2 SP1(.NET 2.0 ~ .NET 4.0 설치): 정상 동작
Windows Server 2003 x86 SP2(.NET 1.1): Hang 현상 발생




원인을 찾기 위해 procdump를 이용해 hang 걸린 상태에서 풀 덤프를 받고,

procdump -ma [... pid ...]

"Debug Diagnostic Tool"를 이용해 분석해 보았습니다. (1.2 버전부터 많이 좋아져서 ^^ 이것 때문에 windbg 실행할 일이 많이 줄었습니다. ^^)

Debug Diagnostic Tool v1.2
; http://www.microsoft.com/en-us/download/details.aspx?id=26798

결과는 다음과 같습니다.

Thread 0 - System ID 468
This thread is making an outbound RPC call over LPC to the local machine.

.NET Call Stack

Function 
[DEFAULT] I4 Microsoft.Win32.UnsafeNativeMethods.RegQueryValueEx(ValueClass System.Runtime.InteropServices.HandleRef,String,SZArray I4,SZArray I4,ValueClass System.Runtime.InteropServices.HandleRef,ByRef I4) 
[hasThis] I System.Diagnostics.PerformanceMonitor.GetData(String) 
[hasThis] I System.Diagnostics.PerformanceCounterLib.GetPerformanceData(String) 
[hasThis] Class System.Collections.Hashtable System.Diagnostics.PerformanceCounterLib.get_CategoryTable() 
[hasThis] I System.Diagnostics.PerformanceCounterLib.GetPerformanceData(SZArray String,SZArray I4) 
Full Call Stack

Function   Source 
ntdll!KiFastSystemCallRet    
ntdll!ZwRequestWaitReplyPort+c    
rpcrt4!LRPC_CCALL::SendReceive+230    
rpcrt4!I_RpcSendReceive+24    
rpcrt4!NdrSendReceive+2b    
rpcrt4!NdrClientCall2+22e    
advapi32!RStartServiceW+1c    
advapi32!StartServiceW+1e
wmiaprpl!WmiAdapterWrapper::Open+8d    
advapi32!OpenExtObjectLibrary+699    
advapi32!QueryExtensibleData+473    
advapi32!PerfRegQueryValue+536    
advapi32!LocalBaseRegQueryValue+306    
advapi32!RegQueryValueExW+96    
0x009ca8ad    
[DEFAULT] [hasThis] I System.Diagnostics.PerformanceCounterLib.GetPerformanceData(String)    
[DEFAULT] [hasThis] Class System.Collections.Hashtable System.Diagnostics.PerformanceCounterLib.get_CategoryTable()    
[DEFAULT] [hasThis] I System.Diagnostics.PerformanceCounterLib.GetPerformanceData(SZArray String,SZArray I4)    
[DEFAULT] SZArray Class System.Diagnostics.ProcessInfo System.Diagnostics.NtProcessManager.GetProcessInfos(Class System.Diagnostics.PerformanceCounterLib)    
[DEFAULT] SZArray Class System.Diagnostics.ProcessInfo System.Diagnostics.NtProcessManager.GetProcessInfos(String,Boolean)    
[DEFAULT] SZArray Class System.Diagnostics.ProcessInfo System.Diagnostics.ProcessManager.GetProcessInfos(String)    
mscorwks!CallDescrWorker+30    
mscorwks!MethodDesc::CallDescr+1b8    
mscorwks!MethodDesc::CallDescr+4f    
mscorwks!MethodDesc::Call+97    
mscorwks!ClassLoader::CanAccess+1d6    
mscorwks!ClassLoader::ExecuteMainMethod+49d    
mscorwks!Assembly::ExecuteMainMethod+21    
mscorwks!SystemDomain::ExecuteMainMethod+421    
mscorwks!ExecuteEXE+1ce    
mscorwks!_CorExeMain+59    
mscoree!_CorExeMain+2c    
kernel32!BaseProcessStart+23    


Outbound RPC Call:

Protocol Sequence    ncalrpc 
Endpoint ntsvcs 

처음에는 콜 스택이 눈에 잘 안들어와서 문제가 뭔지 몰랐는데, 마지막의 LPC Endpoint 정보에 ntsvcs가 있는 것을 보고 이것이 뭔지 찾아봐야만 했습니다.

Well-known MSRPC named pipes
; http://www.hsc.fr/ressources/articles/win_net_srv/well_known_named_pipes.html

위의 웹 페이지에 보면, ntsvcs에 대해 다음과 같은 정보를 찾을 수 있습니다.

Named pipe: svcctl (ntsvcs alias)
Description: svcctl interface (Services control manager)
Service or process: services.exe
Interface identifier: 367aeb81-9844-35f1-ad32-98f038001003 v2.0

다시 svcctl 정보를 파고 들어가면 다음의 API가 눈에 띕니다.

Interface: 367aeb81-9844-35f1-ad32-98f038001003 v2.0: svcctl
Operation number: 0x13
Operation name: StartServiceW
Windows API: StartService

아하... 이제야 이해가 되는군요.

대강 짐작되는 바는 이렇습니다. Main 메서드에서 Process.GetProcessesByName을 호출했더니, 이것은 내부적으로 System.Diagnostics.PerformanceCounterLib.GetPerformanceData를 부릅니다. 성능 카운터 접속은 내부적으로 SCM에게 또 다른 서비스를 시작하라는 "advapi32!StartServiceW" Win32 API를 호출하였고 이것이 LPC 호출로 SCM 프로세스(services.exe)에게 전달된 것입니다.

그 순간에, SCM 프로세스는 이미 Process.GetProcessesByName을 호출한 서비스가 완료되기를 기다리고 있기 때문에 dead-lock 상태에 빠져 버린 것입니다.




그런데, 어떤 서비스를 시작시키려고 그랬던 것일까요? 그냥 감이 옵니다. ^^ 콜스택에 보니 "wmiaprpl!WmiAdapterWrapper"라는 정보로 봐서 아마도 WMI가 아닐까 싶었는데, 의외로 이미 해당 서비스(Winmgmt: Windows Management Instrumentation)는 실행된 상태입니다.

그래도 혹시나 싶어, 정상 동작하던 동일한 운영체제의 Windows Server 2003에서 일부러 WMI 서비스를 정지시키고 테스트를 해보니 정말로 hang 현상이 발생했습니다. ^^

마찬가지로 .NET에서 성능 카운터 호출로 연결되는 또 다른 기능을 사용해도 (가령: Process.GetCurrentProcess().VirtualMemorySize) 동일한 현상이 재현되었고.

문제를 정리해 보면, 결국 StartServiceW 메서드의 호출을 발생시킨 부모 API 중에서 WMI에 의존하도록 만든 호출이 있다는 것입니다.
advapi32!StartServiceW+1e
wmiaprpl!WmiAdapterWrapper::Open+8d    
advapi32!OpenExtObjectLibrary+699    
advapi32!QueryExtensibleData+473    
advapi32!PerfRegQueryValue+536    
advapi32!LocalBaseRegQueryValue+306    
advapi32!RegQueryValueExW+96    

2대의 PC에서 advapi32.dll을 비교해 보니, 잘 되던 2003 서버는 "5.2.3790.4555"이고 hang 현상이 발생했던 2003 서버는 "5.2.3790.4455"으로 다르긴 합니다.

결국, 정상적으로 윈도우 업데이트가 안되던 운영체제가 문제였던 것입니다.

휴~~~ 이래서 테스트 장비는 다양해야 합니다. ^^

그러고 보니, 해결 방법을 빼놓았군요. 그냥 초기화 코드를 Main 메서드가 아닌 Service 클래스의 OnStart로 옮기는 것으로 간단하게 마무리 했습니다.




[이 글에 대해서 여러분들과 의견을 공유하고 싶습니다. 틀리거나 미흡한 부분 또는 의문 사항이 있으시면 언제든 댓글 남겨주십시오.]







[최초 등록일: ]
[최종 수정일: 7/5/2021]

Creative Commons License
이 저작물은 크리에이티브 커먼즈 코리아 저작자표시-비영리-변경금지 2.0 대한민국 라이센스에 따라 이용하실 수 있습니다.
by SeongTae Jeong, mailto:techsharer at outlook.com

비밀번호

댓글 작성자
 



2013-04-29 08시29분
[ryujh] 안녕하세요.

이 글을 읽다가

'원인을 찾기 위해 procdump를 이용해 hang 걸린 상태에서 풀 덤프를 받고'

여기서 부터 저라면 어떻게 할 수 없었을 텐데... 끝까지 읽으니까 감탄만 나오네요.

요즘은 개발이 아니고 고객지원을 하다보니 디버그도 필요하고 공부할게 더 많아지는 군요.

이상입니다.
[guest]

... 121  122  123  124  125  126  127  128  129  130  [131]  132  133  134  135  ...
NoWriterDateCnt.TitleFile(s)
1780정성태10/15/201424123오류 유형: 249. The application-specific permission settings do not grant Local Activation permission for the COM Server application with CLSID
1779정성태10/15/201419641오류 유형: 248. Active Directory에서 OU가 지워지지 않는 경우
1778정성태10/10/201418076오류 유형: 247. The Netlogon service could not create server share C:\Windows\SYSVOL\sysvol\[도메인명]\SCRIPTS.
1777정성태10/10/201421186오류 유형: 246. The processing of Group Policy failed. Windows attempted to read the file \\[도메인]\sysvol\[도메인]\Policies\{...GUID...}\gpt.ini
1776정성태10/10/201418190오류 유형: 245. 이벤트 로그 - Name resolution for the name _ldap._tcp.dc._msdcs.[도메인명]. timed out after none of the configured DNS servers responded.
1775정성태10/9/201419306오류 유형: 244. Visual Studio 디버깅 (2) - Unable to break execution. This process is not currently executing the type of code that you selected to debug.
1774정성태10/9/201426541개발 환경 구성: 246. IIS 작업자 프로세스의 20분 자동 재생(Recycle)을 끄는 방법
1773정성태10/8/201429731.NET Framework: 471. 웹 브라우저로 다운로드가 되는 파일을 왜 C# 코드로 하면 안되는 걸까요? [1]
1772정성태10/3/201418490.NET Framework: 470. C# 3.0의 기본 인자(default parameter)가 .NET 1.1/2.0에서도 실행될까? [3]
1771정성태10/2/201428009개발 환경 구성: 245. 실행된 프로세스(EXE)의 명령행 인자를 확인하고 싶다면 - Sysmon [4]
1770정성태10/2/201421621개발 환경 구성: 244. 매크로 정의를 이용해 파일 하나로 C++과 C#에서 공유하는 방법 [1]파일 다운로드1
1769정성태10/1/201424037개발 환경 구성: 243. Scala 개발 환경 구성(JVM, 닷넷) [1]
1768정성태10/1/201419432개발 환경 구성: 242. 배치 파일에서 Thread.Sleep 효과를 주는 방법 [5]
1767정성태10/1/201424588VS.NET IDE: 94. Visual Studio 2012/2013에서의 매크로 구현 - Visual Commander [2]
1766정성태10/1/201422394개발 환경 구성: 241. 책 "프로그래밍 클로저: Lisp"을 읽고 나서. [1]
1765정성태9/30/201425967.NET Framework: 469. Unity3d에서 transform을 변수에 할당해 사용하는 특별한 이유가 있을까요?
1764정성태9/30/201422206오류 유형: 243. 파일 삭제가 안 되는 경우 - The action can't be comleted because the file is open in System
1763정성태9/30/201423814.NET Framework: 468. PDB 파일을 연동해 소스 코드 라인 정보를 알아내는 방법파일 다운로드1
1762정성태9/30/201424508.NET Framework: 467. 닷넷에서 EIP/RIP 레지스터 값을 구하는 방법 [1]파일 다운로드1
1761정성태9/29/201421513.NET Framework: 466. 윈도우 운영체제의 보안 그룹 이름 및 설명 문자열을 바꾸는 방법파일 다운로드1
1760정성태9/28/201419773.NET Framework: 465. ICorProfilerInfo::GetILToNativeMapping 메서드가 0x80131358을 반환하는 경우
1759정성태9/27/201430957개발 환경 구성: 240. Visual C++ / x64 환경에서 inline-assembly를 매크로 어셈블리로 대체하는 방법파일 다운로드1
1758정성태9/23/201437784개발 환경 구성: 239. 원격 데스크톱 접속(RDP)을 기존의 콘솔 모드처럼 사용하는 방법 [1]
1757정성태9/23/201418362오류 유형: 242. Lync로 모임 참여 시 소리만 들리지 않는 경우 - 두 번째 이야기
1756정성태9/23/201427351기타: 48. NVidia 제품의 과다한 디스크 사용 [2]
1755정성태9/22/201434137오류 유형: 241. Unity Web Player를 설치해도 여전히 설치하라는 화면이 나오는 경우 [4]
... 121  122  123  124  125  126  127  128  129  130  [131]  132  133  134  135  ...