Microsoft MVP성태의 닷넷 이야기
글쓴 사람
정성태 (techsharer at outlook.com)
홈페이지
첨부 파일
 

"Probabilistic Programming and Bayesian Methods for Hackers" 예제 코드 실행 방법

얼마 전 트위터에서 본 내용입니다.

확률이론과 베이즈추론법 프로그래밍에 관한 전자책 Bayesian Methods for Hackers. Python기반.
; https://twitter.com/sjoonk/status/344658745562914816

PDF로 다운로드 받아서 보면 다음과 같이 책에 직접 실행해 볼 수 있는 파이썬 코드가 들어 있습니다.

bayesian_python_code_0.png

윈도우에서 쉽게 이를 테스트 해보려면 "EPD(Enthought Python Distribution)"를 다운로드하시면 됩니다.

Enthought Python Distribution Free
; https://www.enthought.com/products/epd/free/

Download Canopy 1.0, 32-bit for Windows
; https://www.enthought.com/downloads/

위의 무료 버전을 설치하고 실행하면 다음과 같은 화면이 나옵니다.

bayesian_python_code_1.png

Canopy 도구에서는 다행히 "Probabilistic Programming and Bayesian Methods for Hackers" 책에서 요구하는 구성 요소(enstaller, ipython)를 미리 내장하고 있기 때문에 더 이상 별도로 다운로드는 하지 않아도 됩니다. 단지, "Package Manager"를 실행해서 "Updates" 항목에 새로 업데이트 받을 것이 있다면 기분상 해주시면 됩니다.

자... 이제 Editor 버튼을 누르고, 우측의 "In" 명령 프롬프트에서 차례로 본문의 코드를 입력해 주면,

%pylab inline

figsize( 11, 9)

import scipy.stats as stats
dist = stats.beta
n_trials = [0,1,2,3,4,5,8,15, 50, 500]
data = stats.bernoulli.rvs(0.5, size = n_trials[-1] )
x = np.linspace(0,1,100)

for k, N in enumerate(n_trials):
    sx = subplot( len(n_trials)/2, 2, k+1)
    plt.xlabel("$p$, probability of heads") if k in [0,len(n_trials)-1] else None
    plt.setp(sx.get_yticklabels(), visible=False)
    heads = data[:N].sum()
    y = dist.pdf(x, 1 + heads, 1 + N - heads )
    plt.plot( x, y, label= "observe %d tosses,\n %d heads"%(N,heads) )
    plt.fill_between( x, 0, y, color="#348ABD", alpha = 0.4 )
    plt.vlines( 0.5, 0, 4, color = "k", linestyles = "--", lw=1 )
    leg = plt.legend()
    leg.get_frame().set_alpha(0.4)
    plt.autoscale(tight = True)

plt.suptitle( "Bayesian updating of posterior probabilities",
y = 1.02,
fontsize = 14);
plt.tight_layout()

다음과 같이 실행이 되는 것을 확인할 수 있습니다.

bayesian_python_code_2.png

그런데, 이걸 코드 파일로 해서 실행해 볼 수는 없을까요? 내용을 다음과 같이 다소 바꿔주면 됩니다. ^^ (휴~~~ 해당하는 모듈 찾느라 고생했네요. ^^)

import scipy.stats as stats
import matplotlib.pyplot as plt
import numpy as np

plt.figsize(11, 9)

dist = stats.beta
n_trials = [0,1,2,3,4,5,8,15, 50, 500]
data = stats.bernoulli.rvs(0.5, size = n_trials[-1] )
x = np.linspace(0,1,100)

for k, N in enumerate(n_trials):
    sx = plt.subplot( len(n_trials)/2, 2, k+1)
    plt.xlabel("$p$, probability of heads") if k in [0,len(n_trials)-1] else None
    plt.setp(sx.get_yticklabels(), visible=False)
    heads = data[:N].sum()
    y = dist.pdf(x, 1 + heads, 1 + N - heads )
    plt.plot( x, y, label= "observe %d tosses,\n %d heads"%(N,heads) )
    plt.fill_between( x, 0, y, color="#348ABD", alpha = 0.4 )
    plt.vlines( 0.5, 0, 4, color = "k", linestyles = "--", lw=1 )
    leg = plt.legend()
    leg.get_frame().set_alpha(0.4)
    plt.autoscale(tight = True)
    
plt.suptitle( "Bayesian updating of posterior probabilities",y = 1.02,fontsize = 14);
plt.tight_layout()

아마 책의 나머지 예제도 위와 같은 규칙을 적용하면 코드 파일로 저장해서 실행할 수 있을 것입니다. 다음은 실제로 실행된 화면입니다. ^^

bayesian_python_code_3.png

그나저나... 정작 책은 언제 다 읽어볼런지...? ^^

참고로, 닷넷의 경우 Bayesian 추론 관련해서 Infer.NET이라는 라이브러리가 있습니다.

Infer.NET
; http://research.microsoft.com/en-us/um/cambridge/projects/infernet/





[이 글에 대해서 여러분들과 의견을 공유하고 싶습니다. 틀리거나 미흡한 부분 또는 의문 사항이 있으시면 언제든 댓글 남겨주십시오.]







[최초 등록일: ]
[최종 수정일: 1/28/2022]

Creative Commons License
이 저작물은 크리에이티브 커먼즈 코리아 저작자표시-비영리-변경금지 2.0 대한민국 라이센스에 따라 이용하실 수 있습니다.
by SeongTae Jeong, mailto:techsharer at outlook.com

비밀번호

댓글 작성자
 




... 166  167  168  169  170  171  172  173  174  175  176  [177]  178  179  180  ...
NoWriterDateCnt.TitleFile(s)
569정성태3/16/200824095Team Foundation Server: 24. TFS 2008로 마이그레이션 (2) [2]
566정성태2/28/200825248.NET Framework: 99. AppDomain.GetEntryAssembly()를 우회하는 방법파일 다운로드1
564정성태2/16/200824804Windows: 30. TS Web Access + Vista SP1 [2]
563정성태2/16/200824190오류 유형: 51. Vista(UAC) + 웹 프로젝트 디버깅: System.UnauthorizedAccessException
562정성태2/12/200828589Windows: 29. Windows Server 2008 설치 [4]
561정성태1/10/200822293오류 유형: 50. IE 7 + 잘못된 HTC 파일 경로 = File not found [5]
559정성태1/1/200827188Windows: 28. Vista에서 끌어다 놓기로 GAC 등록하는 방법 [2]
558정성태1/1/200844284개발 환경 구성: 33. 32bit/64bit OLE DB Provider [1]
557정성태12/22/200722755개발 환경 구성: 32. WSCF와 VS.NET 2008
556정성태12/16/200720932기타: 22. 인기 순위 정리 : 조회수 1000 회 이상
555정성태12/16/200723686기타: 21. 인기 순위 정리 : 조회수 500 ~ 999회 글 목록
554정성태12/16/200728295기타: 20. 인기 순위 정리 : 조회수 250 ~ 499회 글 목록
553정성태12/16/200728573기타: 19. 인기 순위 정리 : 조회수 100 ~ 249회 글 목록
552정성태12/16/200722200기타: 18. 인기 순위 정리 : 조회수 000 ~ 099 회 글 목록
550정성태12/16/200721114Team Foundation Server: 23. TFS 2005에서 TFS 2008로 마이그레이션 [2]
549정성태12/16/200722619Team Foundation Server: 22. TFS 설정 - 주소를 도메인으로 변경
548정성태12/15/200740246오류 유형: 49. Report Server - 원격 서버에 연결할 수 없습니다
547정성태12/4/200728701.NET Framework: 98. .NET 비동기 Socket과 스레드
546정성태12/4/200719699Team Foundation Server: 21. Microsoft Office가 참조된 경우의 빌드 환경 구성
545정성태12/4/200726460Windows: 27. 눈으로 확인해 보는 ASLR 기능 [1]
544정성태11/25/200722396오류 유형: 48. VS.NET 2008 설치 오류 - Error code 1602 [5]
543정성태11/25/200725367개발 환경 구성: 31. ROBOCOPY XP026 버전 [1]
542정성태11/3/200740426VS.NET IDE: 55. XML/XSLT로 구현하는 매크로 확장 [5]파일 다운로드2
538정성태10/11/200726895스크립트: 10. VBScript - "Sub를 호출할 때는 괄호를 사용할 수 없습니다." [2]
537정성태9/28/200735527개발 환경 구성: 30. 64비트 OS에서의 ChartFX 라이선스 문제
536정성태9/12/200732320.NET Framework: 97. WCF : netTcpBinding에서의 각종 Timeout 값 설명 [11]
... 166  167  168  169  170  171  172  173  174  175  176  [177]  178  179  180  ...