Microsoft MVP성태의 닷넷 이야기
글쓴 사람
정성태 (techsharer at outlook.com)
홈페이지
첨부 파일
 

"Probabilistic Programming and Bayesian Methods for Hackers" 예제 코드 실행 방법

얼마 전 트위터에서 본 내용입니다.

확률이론과 베이즈추론법 프로그래밍에 관한 전자책 Bayesian Methods for Hackers. Python기반.
; https://twitter.com/sjoonk/status/344658745562914816

PDF로 다운로드 받아서 보면 다음과 같이 책에 직접 실행해 볼 수 있는 파이썬 코드가 들어 있습니다.

bayesian_python_code_0.png

윈도우에서 쉽게 이를 테스트 해보려면 "EPD(Enthought Python Distribution)"를 다운로드하시면 됩니다.

Enthought Python Distribution Free
; https://www.enthought.com/products/epd/free/

Download Canopy 1.0, 32-bit for Windows
; https://www.enthought.com/downloads/

위의 무료 버전을 설치하고 실행하면 다음과 같은 화면이 나옵니다.

bayesian_python_code_1.png

Canopy 도구에서는 다행히 "Probabilistic Programming and Bayesian Methods for Hackers" 책에서 요구하는 구성 요소(enstaller, ipython)를 미리 내장하고 있기 때문에 더 이상 별도로 다운로드는 하지 않아도 됩니다. 단지, "Package Manager"를 실행해서 "Updates" 항목에 새로 업데이트 받을 것이 있다면 기분상 해주시면 됩니다.

자... 이제 Editor 버튼을 누르고, 우측의 "In" 명령 프롬프트에서 차례로 본문의 코드를 입력해 주면,

%pylab inline

figsize( 11, 9)

import scipy.stats as stats
dist = stats.beta
n_trials = [0,1,2,3,4,5,8,15, 50, 500]
data = stats.bernoulli.rvs(0.5, size = n_trials[-1] )
x = np.linspace(0,1,100)

for k, N in enumerate(n_trials):
    sx = subplot( len(n_trials)/2, 2, k+1)
    plt.xlabel("$p$, probability of heads") if k in [0,len(n_trials)-1] else None
    plt.setp(sx.get_yticklabels(), visible=False)
    heads = data[:N].sum()
    y = dist.pdf(x, 1 + heads, 1 + N - heads )
    plt.plot( x, y, label= "observe %d tosses,\n %d heads"%(N,heads) )
    plt.fill_between( x, 0, y, color="#348ABD", alpha = 0.4 )
    plt.vlines( 0.5, 0, 4, color = "k", linestyles = "--", lw=1 )
    leg = plt.legend()
    leg.get_frame().set_alpha(0.4)
    plt.autoscale(tight = True)

plt.suptitle( "Bayesian updating of posterior probabilities",
y = 1.02,
fontsize = 14);
plt.tight_layout()

다음과 같이 실행이 되는 것을 확인할 수 있습니다.

bayesian_python_code_2.png

그런데, 이걸 코드 파일로 해서 실행해 볼 수는 없을까요? 내용을 다음과 같이 다소 바꿔주면 됩니다. ^^ (휴~~~ 해당하는 모듈 찾느라 고생했네요. ^^)

import scipy.stats as stats
import matplotlib.pyplot as plt
import numpy as np

plt.figsize(11, 9)

dist = stats.beta
n_trials = [0,1,2,3,4,5,8,15, 50, 500]
data = stats.bernoulli.rvs(0.5, size = n_trials[-1] )
x = np.linspace(0,1,100)

for k, N in enumerate(n_trials):
    sx = plt.subplot( len(n_trials)/2, 2, k+1)
    plt.xlabel("$p$, probability of heads") if k in [0,len(n_trials)-1] else None
    plt.setp(sx.get_yticklabels(), visible=False)
    heads = data[:N].sum()
    y = dist.pdf(x, 1 + heads, 1 + N - heads )
    plt.plot( x, y, label= "observe %d tosses,\n %d heads"%(N,heads) )
    plt.fill_between( x, 0, y, color="#348ABD", alpha = 0.4 )
    plt.vlines( 0.5, 0, 4, color = "k", linestyles = "--", lw=1 )
    leg = plt.legend()
    leg.get_frame().set_alpha(0.4)
    plt.autoscale(tight = True)
    
plt.suptitle( "Bayesian updating of posterior probabilities",y = 1.02,fontsize = 14);
plt.tight_layout()

아마 책의 나머지 예제도 위와 같은 규칙을 적용하면 코드 파일로 저장해서 실행할 수 있을 것입니다. 다음은 실제로 실행된 화면입니다. ^^

bayesian_python_code_3.png

그나저나... 정작 책은 언제 다 읽어볼런지...? ^^

참고로, 닷넷의 경우 Bayesian 추론 관련해서 Infer.NET이라는 라이브러리가 있습니다.

Infer.NET
; http://research.microsoft.com/en-us/um/cambridge/projects/infernet/





[이 글에 대해서 여러분들과 의견을 공유하고 싶습니다. 틀리거나 미흡한 부분 또는 의문 사항이 있으시면 언제든 댓글 남겨주십시오.]







[최초 등록일: ]
[최종 수정일: 1/28/2022]

Creative Commons License
이 저작물은 크리에이티브 커먼즈 코리아 저작자표시-비영리-변경금지 2.0 대한민국 라이센스에 따라 이용하실 수 있습니다.
by SeongTae Jeong, mailto:techsharer at outlook.com

비밀번호

댓글 작성자
 




... 61  62  63  64  65  66  67  68  69  70  71  72  73  74  [75]  ...
NoWriterDateCnt.TitleFile(s)
12094정성태12/26/201920949.NET Framework: 873. C# - 코드를 통해 PDB 심벌 파일 다운로드 방법
12093정성태12/26/201920474.NET Framework: 872. C# - 로딩된 Native DLL의 export 함수 목록 출력파일 다운로드1
12092정성태12/25/201918589디버깅 기술: 148. cdb.exe를 이용해 (ntdll.dll 등에 정의된) 커널 구조체 출력하는 방법
12091정성태12/25/201921764디버깅 기술: 147. pdb 파일을 다운로드하기 위한 symchk.exe 실행에 필요한 최소 파일 [1]
12090정성태12/24/201921669.NET Framework: 871. .NET AnyCPU로 빌드된 PE 헤더의 로딩 전/후 차이점 [1]파일 다운로드1
12089정성태12/23/201920016디버깅 기술: 146. gflags와 _CrtIsMemoryBlock을 이용한 Heap 메모리 손상 여부 체크
12088정성태12/23/201919271Linux: 28. Linux - 윈도우의 "Run as different user" 기능을 shell에서 실행하는 방법
12087정성태12/21/201919604디버깅 기술: 145. windbg/sos - Dictionary의 entries 배열 내용을 모두 덤프하는 방법 (do_hashtable.py) [1]
12086정성태12/20/201922560디버깅 기술: 144. windbg - Marshal.FreeHGlobal에서 발생한 덤프 분석 사례
12085정성태12/20/201920628오류 유형: 586. iisreset - The data is invalid. (2147942413, 8007000d) 오류 발생 - 두 번째 이야기 [1]
12084정성태12/19/201920852디버깅 기술: 143. windbg/sos - Hashtable의 buckets 배열 내용을 모두 덤프하는 방법 (do_hashtable.py) [1]
12083정성태12/17/201923622Linux: 27. linux - lldb를 이용한 .NET Core 응용 프로그램의 메모리 덤프 분석 방법 [2]
12082정성태12/17/201922019오류 유형: 585. lsof: WARNING: can't stat() fuse.gvfsd-fuse file system
12081정성태12/16/201924085개발 환경 구성: 465. 로컬 PC에서 개발 중인 ASP.NET Core 웹 응용 프로그램을 다른 PC에서도 접근하는 방법 [5]
12080정성태12/16/201920764.NET Framework: 870. C# - 프로세스의 모든 핸들을 열람
12079정성태12/13/201923248오류 유형: 584. 원격 데스크톱(rdp) 환경에서 다중 또는 고용량 파일 복사 시 "Unspecified error" 오류 발생
12078정성태12/13/201922982Linux: 26. .NET Core 응용 프로그램을 위한 메모리 덤프 방법 [3]
12077정성태12/13/201921324Linux: 25. 자주 실행할 명령어 또는 초기 환경을 "~/.bashrc" 파일에 등록
12076정성태12/12/201920502디버깅 기술: 142. Linux - lldb 환경에서 sos 확장 명령어를 이용한 닷넷 프로세스 디버깅 - 배포 방법에 따른 차이
12075정성태12/11/201921257디버깅 기술: 141. Linux - lldb 환경에서 sos 확장 명령어를 이용한 닷넷 프로세스 디버깅
12074정성태12/10/201920974디버깅 기술: 140. windbg/Visual Studio - 값이 변경된 경우를 위한 정지점(BP) 설정(Data Breakpoint)
12073정성태12/10/201921767Linux: 24. Linux/C# - 실행 파일이 아닌 스크립트 형식의 명령어를 Process.Start로 실행하는 방법
12072정성태12/9/201918486오류 유형: 583. iisreset 수행 시 "No such interface supported" 오류
12071정성태12/9/201922614오류 유형: 582. 리눅스 디스크 공간 부족 및 safemode 부팅 방법
12070정성태12/9/201924260오류 유형: 581. resize2fs: Bad magic number in super-block while trying to open /dev/.../root
12069정성태12/2/201921170디버깅 기술: 139. windbg - x64 덤프 분석 시 메서드의 인자 또는 로컬 변수의 값을 확인하는 방법
... 61  62  63  64  65  66  67  68  69  70  71  72  73  74  [75]  ...