Microsoft MVP성태의 닷넷 이야기
Math: 51. MathNET + OxyPlot을 이용한 간단한 통계 정보 처리 - Histogram [링크 복사], [링크+제목 복사],
조회: 22592
글쓴 사람
정성태 (techsharer at outlook.com)
홈페이지
첨부 파일
(연관된 글이 2개 있습니다.)

MathNET + OxyPlot을 이용한 간단한 통계 정보 처리 - Histogram

MathNET Numerics 라이브러리의,

C# - MathNet.Numerics의 Matrix(행렬) 연산
; https://www.sysnet.pe.kr/2/0/11910

통계 관련한 간단한 사용법을 볼까요? ^^ 우선, 다양한 평균에 대한 메서드입니다.

int [] heightInfo = LoadData("data.txt");

double [] dblHeights = (from elem in heightInfo
                    select (double)elem).ToArray();

Console.WriteLine($"Mean: {Statistics.Mean(dblHeights)}"); // 산술평균
Console.WriteLine($"GeometricMean: {Statistics.GeometricMean(dblHeights)}"); // 기하평균
Console.WriteLine($"HarmonicMean: {Statistics.HarmonicMean(dblHeights)}"); // 조화평균
Console.WriteLine($"RootMeanSquare: {Statistics.RootMeanSquare(dblHeights)}"); // 제곱평균

자동 히스토그램은 구간 수만 정해 주면 됩니다.

Histogram hist = new Histogram(dblHeights, 6);

또는, 상/하위 구간을 지정해 줄 수도 있습니다.

Histogram hist = new Histogram(dblHeights, 6, 141, 170);

아니면, 구간 자체를 사용자 정의하는 것도 가능합니다.

Histogram hist = new Histogram();

hist.AddBucket(new Bucket(141, 145));
hist.AddBucket(new Bucket(145, 150));
hist.AddBucket(new Bucket(150, 155));
hist.AddBucket(new Bucket(155, 160));
hist.AddBucket(new Bucket(160, 165));
hist.AddBucket(new Bucket(165, 170));

hist.AddData(dblHeights);

보는 바와 같이 계급 구간을 Bucket 타입으로 지정하는데,

public Bucket(double lowerBound, double upperBound);

상/하한 기준 값이 double이라는 점과 데이터 비교 기준이 다음과 같다는 점을 염두에 두어야 합니다.

(lowerBound, upperBound]

lowerBound < x <= upperBound

따라서 145 값을 주면 0번 Bucket에 계산되지만, 145.1을 주면 1번 Bucket에 계산됩니다.

상/하한 기준 값이 double이라는 점 때문에 계급값을 범용적으로 계산하는 것도 좀 이상해지긴 하지만, 그런 탓인지 Bucket 타입에는 계급값에 대한 속성이 없습니다. 또한, Histogram의 경우 계급값과 상대도수를 이용한 평균을 내주는 기능도 없으므로 이런 부분들은 임의로 여러분들이 다음과 같은 확장 메서드를 만들어 주어야 합니다.

public static class BucketExtension
{
    public static double GetClassMark(this Bucket bucket)
    {
        return Math.Round((bucket.LowerBound + bucket.UpperBound) / 2, MidpointRounding.AwayFromZero);
    }

    public static double GetRelativeFrequency(this Bucket bucket, Histogram histogram)
    {
        return bucket.Count / histogram.DataCount;
    }
}

public static class HistogramExtension
{
    public static void Output(this Histogram histogram)
    {
        for (int i = 0; i < histogram.BucketCount; i++)
        {
            Console.WriteLine($"{histogram[i].GetClassMark()} == {histogram[i].Count}");
        }
    }

    public static double Mean(this Histogram histogram)
    {
        double mean = 0.0;

        for (int i = 0; i < histogram.BucketCount; i++)
        {
            Bucket bucket = histogram[i];

            double classMark = bucket.GetClassMark();
            double relativeFrequency = bucket.GetRelativeFrequency(histogram);

            mean += (classMark * relativeFrequency);
        }

        return mean;
    }
}

그래서 다음과 같은 정도로 사용해 줄 수 있습니다.

Histogram hist = new Histogram();

hist.AddBucket(new Bucket(141, 145));
hist.AddBucket(new Bucket(145, 150));
hist.AddBucket(new Bucket(150, 155));
hist.AddBucket(new Bucket(155, 160));
hist.AddBucket(new Bucket(160, 165));
hist.AddBucket(new Bucket(165, 170));

hist.AddData(dblHeights);
hist.Output();
Console.WriteLine($"Mean of histogram: {hist.GetMean()}");

/*
출력 결과:
143 == 1
148 == 6
153 == 19
158 == 30
163 == 18
168 == 6
Mean of histogram: 157.75
*/




그래도 히스토그램은 역시 그래프로 봐야 제맛이죠? ^^

OxyPlot을 이용해,

C# Plotting 라이브러리 OxyPlot
; https://www.sysnet.pe.kr/2/0/10973

C# - OxyPlot 라이브러리로 복소수 표현
; https://www.sysnet.pe.kr/2/0/10974

Docs / Model / Series
; http://docs.oxyplot.org/en/latest/models/series/index.html

다음과 같은 정도로 그려낼 수 있습니다.

Histogram hist = GetHistogram(dblHeights);
plotView1.Model = GetHistogramModel(hist);

public PlotModel GetHistogramModel(Histogram hist)
{
    PlotModel model = new PlotModel();

    CategoryAxis xaxis = new CategoryAxis();
    xaxis.Position = AxisPosition.Bottom;
    xaxis.MajorGridlineStyle = LineStyle.Solid;
    xaxis.MinorGridlineStyle = LineStyle.Dot;

    for (int i = 0; i < hist.BucketCount; i++)
    {
        xaxis.Labels.Add(hist[i].GetClassMark().ToString());
    }

    LinearAxis yaxis = new LinearAxis();
    yaxis.Position = AxisPosition.Left;
    yaxis.MajorGridlineStyle = LineStyle.Dot;
    xaxis.MinorGridlineStyle = LineStyle.Dot;

    ColumnSeries series = new ColumnSeries();
    series.IsStacked = true;
    series.LabelPlacement = LabelPlacement.Base;
    series.LabelFormatString = "{0}";

    for (int i = 0; i < hist.BucketCount; i++)
    {
        ColumnItem item = new ColumnItem(hist[i].Count);
        series.Items.Add(item);
    }

    model = new PlotModel();
    model.Title = "Histogram";

    model.Axes.Add(xaxis);
    model.Axes.Add(yaxis);
    model.Series.Add(series);

    return model;
}

plotview_1.png

(첨부 파일은 이 글의 소스 코드를 포함합니다.)




[이 글에 대해서 여러분들과 의견을 공유하고 싶습니다. 틀리거나 미흡한 부분 또는 의문 사항이 있으시면 언제든 댓글 남겨주십시오.]

[연관 글]






[최초 등록일: ]
[최종 수정일: 5/24/2019]

Creative Commons License
이 저작물은 크리에이티브 커먼즈 코리아 저작자표시-비영리-변경금지 2.0 대한민국 라이센스에 따라 이용하실 수 있습니다.
by SeongTae Jeong, mailto:techsharer at outlook.com

비밀번호

댓글 작성자
 




... 166  167  168  169  170  171  [172]  173  174  175  176  177  178  179  180  ...
NoWriterDateCnt.TitleFile(s)
776정성태9/17/200925726개발 환경 구성: 50. Reference assembly
775정성태9/13/200942469VC++: 37. XmlCodeGenerator를 C/C++ 코드 생성에 적용 [2]파일 다운로드1
773정성태9/5/200933287오류 유형 : 85. DEP 비호환 ActiveX 오류
772정성태9/2/200929537.NET Framework: 161. WPF - 윈도우 이벤트 가로채기 [1]파일 다운로드1
771정성태8/28/200923490.NET Framework: 160. WPF - 입력 포커스 외곽선 없애는 방법
770정성태8/26/200926172.NET Framework: 159. WCF - 같은 컴퓨터에서만 WCF 요청을 서비스하도록 설정
769정성태8/25/200929242개발 환경 구성: 49. GAC와 같은 Namespace Extension에 의해서 보여지는 폴더의 원본 확인 방법
768정성태8/24/200928580오류 유형: 85. WCF 연결 오류: MessageSecurityException
767정성태8/23/200936760.NET Framework: 158. 닷넷 프로파일러 - IL 코드 재작성 [14]
766정성태8/23/200937776.NET Framework: 157. C# 4.0 - dynamic 키워드 [4]파일 다운로드1
765정성태8/22/200931525.NET Framework: 156. XamDataGrid의 UnboundField 사용파일 다운로드1
764정성태8/21/200925831Windows: 47. Windows Virtual PC에 설치된 Windows 7 VPC에서 Aero 효과 사용 [3]
763정성태8/20/200929339Windows: 46. Windows 7 - XP 모드 응용 프로그램 바로가기 만드는 방법 [2]
762정성태8/18/200934829개발 환경 구성: 48. 개발자 PC 환경 - 유니코드(Unicode)를 위한 설정 [3]
760정성태8/17/200941323개발 환경 구성: 47. XmlCodeGenerator 1.0.0.4 업데이트 [2]
759정성태8/16/200933135.NET Framework: 155. 닷넷 프로파일러의 또 다른 응용: Visual Studio 2010 Historical Debugging
758정성태8/15/200926739VS.NET IDE: 65. WPF 프로젝트용 Visual Studio 패치들 [2]
757정성태8/12/200926090오류 유형: 84. TFS 작업 항목 보기 오류 - WorkItemTypeDeniedOrNotExistException
756정성태8/9/200925316오류 유형: 83. A revocation check could not be performed for the certificate.
755정성태8/6/200922978.NET Framework: 154. 이벤트 2중 구독
754정성태7/16/200935503VS.NET IDE: 64. Visual Studio 2010 - 64bit 혼합 모드 디버깅 지원
753정성태7/15/200934004.NET Framework: 153. WPF와 WinForm의 Shown 이벤트 시점
752정성태7/14/200929753개발 환경 구성: 46. .NET Service Bus 응용 사례: SocketShifter [2]파일 다운로드1
751정성태7/9/200930670.NET Framework: 152. 순환 참조와 XmlSerializer파일 다운로드1
750정성태7/7/200931067.NET Framework: 151. Team Explorer가 설치되지 않은 PC에서 System.InvalidProgramException 예외 발생파일 다운로드1
748정성태7/2/200929458.NET Framework: 150. WPF - Property Element 사용 의미파일 다운로드2
... 166  167  168  169  170  171  [172]  173  174  175  176  177  178  179  180  ...