Microsoft MVP성태의 닷넷 이야기
글쓴 사람
정성태 (techsharer at outlook.com)
홈페이지
첨부 파일

(시리즈 글이 7개 있습니다.)
Math: 15. 그래프 그리기로 알아보는 뉴턴-랩슨(Newton-Raphson's method)법과 제곱근 구하기 - C#
; https://www.sysnet.pe.kr/2/0/10911

Math: 53. C# - 행렬식을 이용한 최소 자승법(LSM: Least Square Method)
; https://www.sysnet.pe.kr/2/0/11918

Math: 54. C# - 최소 자승법의 1차 함수에 대한 매개변수를 단순 for 문으로 구하는 방법
; https://www.sysnet.pe.kr/2/0/11919

Math: 55. C# - 다항식을 위한 최소 자승법(Least Squares Method)
; https://www.sysnet.pe.kr/2/0/11921

Math: 56. C# - 그래프 그리기로 알아보는 경사 하강법의 최소/최댓값 구하기
; https://www.sysnet.pe.kr/2/0/11923

Math: 57. C# - 해석학적 방법을 이용한 최소 자승법
; https://www.sysnet.pe.kr/2/0/11924

Math: 58. C# - 최소 자승법의 1차, 2차 수렴 그래프 변화 확인
; https://www.sysnet.pe.kr/2/0/11936




C# - 그래프 그리기로 알아보는 경사 하강법의 최소/최대 값 구하기

예전에 미분을 이용한,

그래프 그리기로 알아보는 뉴턴-랩슨(Newton-Raphson's method)법과 제곱근 구하기 - C#
; https://www.sysnet.pe.kr/2/0/10911

방정식의 근사해를 알아본 적이 있는데요. 도함수의 다음과 같은 특성을 이용하면,

f' < 0: 최솟값은 우측에.
f' = 0: 최솟값
f' > 0: 최솟값은 좌측에.

최솟값을 (그 반대로는 최댓값을) 근사할 수 있습니다. 예를 들어, f(x) = x^2 - 2x + 1이라는 방정식이 있다면,

gradient_descent_1.png

이것의 도함수는 f'(x) = 2x - 2가 되고, (무작위로 선정한) x = 10으로 시작하는 경우 최솟값을 다음과 같이 이동하면서 근사할 수 있습니다.

f'(10) = 18 > 0: 최솟값은 좌측에 있으므로 다음번 x는 좀 더 작게 시도.
f'( 9) = 16 > 0:  "
f'( 8) = 14 > 0:  "
...            :  "
f'( 1) =  0 = 0:  최솟값

물론 위의 경우에는 1씩 줄여나가다 운이 좋아 정확히 최솟값 위치에 왔지만 단순하지 않은 상황에서는 근삿값에 대한 범위를 마련하고 그것을 만족하는 수준이거나, 아니면 근삿값으로 진행하는 과정 중에 원하는 수준만큼의 변화가 없다면 중단하는 식으로 작성하면 됩니다.

코드로 만들어 보면,

using MathNet.Numerics.Random;
using PLplot;
using System;
using System.Linq;

namespace ConsoleApp2
{
    class Program
    {
        static void Main(string[] args)
        {
            Func<double, double> f = (x) => (x - 1) * (x - 1);
            Func<double, double> df = (x) => 2 * x - 2;

            // 그래프 출력
            DrawPlotChart(-14, 14, -10, 120, f, df);
        }

        private static void DrawPlotChart(double xMin, double xMax, double yMin, double yMax, 
            Func<double, double> orgDrawFunc, Func<double, double> dfDrawFunc)
        {
            string chartFileName = "click.svg";

            using (var pl = new PLStream())
            {
                pl.sdev("svg");
                pl.sfnam(chartFileName);
                pl.spal0("cmap0_alternate.pal");
                pl.init();

                pl.env(xMin, xMax, yMin, yMax, AxesScale.Independent, AxisBox.BoxTicksLabelsAxes);
                pl.lab("X", "Y", "y = x^2 - 2x + 1");

                pl.spal0("");
                pl.col0(PLplot.Color.Blue);

                // y = x ^ 2 - 2x + 1 그래프를 그리고,
                {
                    double[] ptX = Utils.RangeInclusive(xMin, xMax, 0.01).ToArray();
                    double[] ptY = null;

                    ptY = new double[ptX.Length];
                    for (int i = 0; i < ptX.Length; i++)
                    {
                        ptY[i] = orgDrawFunc(ptX[i]);
                    }

                    pl.line(ptX, ptY);
                }

                char code = Symbol.Bullet;
                pl.col0(PLplot.Color.Blue);

                // x = 15에서 시작해 도함수의 결과에 따라 0.1씩 변위를 주며 최솟값으로 이동하는 과정을 점으로 출력
                int maxTrial = 1000;
                double anyX = 15.0; // 랜덤 값

                while (maxTrial-- > 0)
                {
                    double yPos = dfDrawFunc(anyX);
                    pl.Point(anyX, orgDrawFunc(anyX), code);

                    if (yPos.GetCloseToZeroSlope())
                    {
                        break;
                    }
                    else anyX += (yPos > 0) ? -0.1 : 0.1;
                }

                pl.eop();
                pl.gver(out var verText);
            }
        }
    }

    public static class Utils
    {
        public static IEnumerable<T> RangeInclusive<T>(T start, T stop, T step)
        {
            dynamic dStart = start;
            dynamic dStop = stop;
            dynamic dStep = step;

            if (dStep == 0)
                throw new ArgumentException("Parameter step cannot equal zero.");

            if (dStart < dStop && dStep > 0)
            {
                for (var i = dStart; i <= dStop; i += dStep)
                {
                    yield return i;
                }
            }
            else if (dStart > dStop && dStep < 0)
            {
                for (var i = dStart; i >= dStop; i += dStep)
                {
                    yield return i;
                }
            }
        }

        public static void Point(this PLStream pl, double x, double y, char code)
        {
            pl.poin(new double[] { x }, new double[] { y }, code);
        }

        public static bool GetCloseToZeroSlope(this double value)
        {
            return Math.Abs(value) < 1e-03 ? true : false;
        }
    }
}

다음과 같은 출력을 얻을 수 있습니다.

gradient_descent_2.png

보는 바와 같이 최솟값으로 잘 수렴하고 있죠! ^^




"그래프 그리기로 알아보는 뉴턴-랩슨(Newton-Raphson's method)법과 제곱근 구하기 - C#" 글을 보면, 도함수로 접근하면서 처음에는 크게 이동하다가 점차 간격이 작아지게 되는데 마찬가지로 경사 하강법도 단순하게 x의 값을 일정 수로 줄여나가기 보다 다음과 같은 식으로 이전 x 값 기준으로 줄여나가는 방식이 있습니다.

x := x - f'(x)

하지만, 단순히 위와 같이 하면 f'(x)의 반환값이 크기 때문에 x 값의 부호를 반대로 만들어 근삿값을 진동하는 식으로 접근하게 됩니다. 이런 문제를 해결하기 위해 약간의 조정값을 f'(x)에 곱해주면,

x := x - n * f'(x) // n == 학습 비율(learning rate)
                   // 예를 들어 n = 0.1

즉, 이전 코드를 다음과 같이 개선한 후,

anyX = 15.0;
double t = 0.1;

while (maxTrial-- > 0)
{
    double yPos = dfDrawFunc(anyX);
    pl.Point(anyX, orgDrawFunc(anyX), code);

    if (yPos.GetCloseToZeroSlope())
    {
        break;
    }
    else anyX -= (t * yPos);
}

결과를 보면, 훨씬 빨리 최솟값으로 수렴하는 것을 확인할 수 있습니다.

gradient_descent_3.png

(첨부 파일은 이 글의 예제 코드를 포함합니다.)




수렴을 좀 더 빨리하기 위해, 데이터에 대한 전처리를 수행하는 과정이 바로 정규화입니다. 예를 들어 이전 글을 보면,

ML.NET 데이터 정규화
; https://www.sysnet.pe.kr/2/0/11922

click.csv 파일의 x 값 범위가 25 ~ 272에 해당하는데 이것을 z-score 정규화를 거치면 -1.7406785589738 ~ 1.94669368859505가 되어 수렴을 시작할 수 있는 랜덤 값 범위를 대폭 줄이게 됩니다.

참고로, 직관적으로 아시겠지만 ^^ 경사 하강법은,

경사 하강법
; https://ko.wikipedia.org/wiki/%EA%B2%BD%EC%82%AC_%ED%95%98%EA%B0%95%EB%B2%95

지역 근사해는 찾아도, 전역 근사해를 찾지 못할 수 있습니다. 아래의 그래프와 같은 상황들을 보면 이해가 되실 것입니다. ^^

gradient_descent_4.png

gradient_descent_5.png

이에 대한 보완으로 "확률 경사 하강법"과 "미니 배치법"이 있다고 하니 좀 더 자세한 사항은 "기초 수학으로 이해하는 머신러닝 알고리즘" 책을 보시면 되겠습니다. ^^




[이 글에 대해서 여러분들과 의견을 공유하고 싶습니다. 틀리거나 미흡한 부분 또는 의문 사항이 있으시면 언제든 댓글 남겨주십시오.]







[최초 등록일: ]
[최종 수정일: 5/31/2019]

Creative Commons License
이 저작물은 크리에이티브 커먼즈 코리아 저작자표시-비영리-변경금지 2.0 대한민국 라이센스에 따라 이용하실 수 있습니다.
by SeongTae Jeong, mailto:techsharer at outlook.com

비밀번호

댓글 작성자
 




... 151  152  [153]  154  155  156  157  158  159  160  161  162  163  164  165  ...
NoWriterDateCnt.TitleFile(s)
1228정성태2/4/201278432.NET Framework: 300. C#으로 만드는 음성인식/TTS 프로그램 [47]파일 다운로드1
1227정성태2/3/201229303.NET Framework: 299. 해당 어셈블리가 Debug 빌드인지, Release 빌드인지 알아내는 방법파일 다운로드1
1226정성태1/28/201270239.NET Framework: 298. 홀 펀칭(Hole Punching)을 이용한 Private IP 간 통신 - C# [15]파일 다운로드3
1225정성태1/24/201225885.NET Framework: 297. 특정 EXE 파일의 실행을 Internet Explorer처럼 "Protected Mode"로 실행하는 방법 [1]파일 다운로드1
1224정성태1/21/201237385개발 환경 구성: 139. 아마존 EC2에 새로 추가된 "1년 무료 Windows 서버 인스턴스"가 있다는데, 직접 만들어 볼까요? ^^ [11]
1223정성태1/20/201227410.NET Framework: 296. 괜찮은 문자열 해시함수? - 두 번째 이야기 [1]파일 다운로드1
1222정성태1/18/201235106.NET Framework: 295. 괜찮은 문자열 해시 함수? [4]파일 다운로드1
1221정성태1/17/201224130오류 유형: 147. System.Runtime.InteropServices.COMException (0x80005000)
1220정성태1/15/201224279.NET Framework: 294. Master web.config 파일을 수정하려면?파일 다운로드1
1219정성태1/15/201226672.NET Framework: 293. Microsoft PowerPoint 슬라이드를 HTML 파일로 ".files" 폴더 없이 저장하는 방법 (C# 코드)파일 다운로드1
1218정성태1/15/201239206.NET Framework: 292. RSACryptoServiceProvider의 공개키와 개인키 구분 [1]파일 다운로드2
1217정성태1/14/201241280.NET Framework: 291. .NET에서 WAV, MP3 파일 재생하는 방법 [1]파일 다운로드1
1216정성태1/14/201229988오류 유형: 146. Microsoft Visual C++ 재배포 패키지 - 설치 로그 남기는 방법 [1]
1215정성태1/9/201227536제니퍼 .NET: 20. 제니퍼 닷넷 적용 사례 (3) - '닷넷'이 문제일까? '닷넷 개발자'가 문제일까? [6]
1214정성태1/3/201224348제니퍼 .NET: 19. 제니퍼 닷넷 설치/제거 방법 - IIS
1213정성태12/31/201124329.NET Framework: 290. WCF - 접속된 클라이언트의 IP 주소 알아내는 방법 - 두 번째 이야기
1212정성태12/31/201124434오류 유형: 145. The trust relationship between this workstation and the primary domain failed.
1211정성태12/31/201129197.NET Framework: 289. WindowsFormsHost를 사용하는 XBAP 응용 프로그램파일 다운로드1
1210정성태12/30/201148192.NET Framework: 288. FFmpeg.exe를 이용한 C# 동영상 인코더 예제 [9]파일 다운로드1
1209정성태12/29/201122843개발 환경 구성: 138. BizTalk 2006 설치 방법
1208정성태12/28/201145841.NET Framework: 287. Excel Sheet를 WinForm에서 사용하는 방법 [8]파일 다운로드2
1207정성태12/26/201125092.NET Framework: 286. x86/x64로 구분된 코드를 포함하는 경우, 다중으로 어셈블리를 만들어야 할까요?파일 다운로드1
1206정성태12/25/201126097.NET Framework: 285. Shader 강좌와 함께 배워보는 XNA Framework (3) - 텍스처 매핑 예제파일 다운로드1
1205정성태12/25/201131734.NET Framework: 284. Thread 개체의 Interrupt와 Abort의 차이점파일 다운로드1
1204정성태12/22/201125259.NET Framework: 283. MEF를 ASP.NET에 성능 손실 없이 적용하려면? [7]
1203정성태12/21/201125593제니퍼 .NET: 18. MEF가 적용된 ASP.NET 웹 사이트를 제니퍼 닷넷으로 모니터링 해본 결과! [6]
... 151  152  [153]  154  155  156  157  158  159  160  161  162  163  164  165  ...