Microsoft MVP성태의 닷넷 이야기
글쓴 사람
정성태 (techsharer at outlook.com)
홈페이지
첨부 파일
(연관된 글이 1개 있습니다.)

C# - 10진수 숫자를 담은 문자열을 숫자로 변환하는 방법

아래와 같은 질문이 있군요.

아스키로 구성된 바이트를 long으로 변환 문의
; https://www.sysnet.pe.kr/3/0/5664

정리해 보면, 숫자를 "문자열"로 가지고 있는 데이터를 다시 숫자로 변환하고 싶은 건데요, 가령 "0000000123" 문자열이 보관된 byte 배열을,

byte [] bytes = /* 소켓 Receive로 받은 바이트 배열 */ Encoding.ASCII.GetBytes("0000000123");

숫자 123으로 변환하고 싶은 것입니다.

string tmp = Encoding.ASCII.GetString(bytes);
long myint = Convert.ToInt64(tmp);

질문자는 위에 대한 코드보다 더 빠른 것을 원하는 건데요, 사실 이런 경우, BCL에서 제공하는 메서드를 다루는 것이 최적화가 잘 된 코드라서 대부분은 충분히 빠르므로 그냥 쓰셔도 좋습니다.

굳이, 아주 미세하게 빠른 속도를 원한다면 GetString 절차를 생략하고 곧바로 바이트 배열로부터 숫자를 바꿀 수 있을 텐데요, 대충 다음과 같은 식으로 만들 수 있습니다.

private static long ConvertToLong(byte[] bytes)
{
    long n = 1;
    long result = 0;

    for (int i = bytes.Length - 1; i >= 0; i --)
    {
        result = result + (bytes[i] - '0') * n;
        n *= 10;
    }

    return result;
}

성능 측정을 해보면 딱히 "감동적인" 수준으로 빠르지는 않습니다. 어쨌든 이렇게 테스트 코드를 구성해서,

using System.Diagnostics;
using System.Text;

internal class Program
{
    static void Main(string[] args)
    {
        Action<int, string, Func<byte[], long>, byte[]> action = (loopCount, title, work, arg) =>
        {
            Stopwatch st = new Stopwatch();
            st.Start();

            Random rand = new Random(Environment.TickCount);

            for (int i = 0; i < loopCount; i++)
            {
                work(arg);
            }

            st.Stop();

            Console.WriteLine(title + " : " + st.ElapsedMilliseconds);
        };

        byte[] buf = Encoding.ASCII.GetBytes("1000000123");

        action(1, "touch-JIT", ConvertNormal, buf);
        action(1, "touch-JIT", ConvertToLong, buf);

        Console.WriteLine();

        action(1000000, "ConvertNormal", ConvertNormal, buf);
        action(1000000, "ConvertToLong", ConvertToLong, buf);
    }

    private static long ConvertNormal(byte[] bytes)
    {
        string tmp = Encoding.ASCII.GetString(bytes);
        return Convert.ToInt64(tmp);
    }
    
    // ...[생략 ConvertToLong]...
}

실행하면 이런 결과가 나옵니다.

ConvertNormal : 36
ConvertToLong : 12

수치상으로 3배 빨라지긴 했는데, 백만 번 수행한 속도 차이이기 때문에 웬만한 고성능을 요구하는 경우가 아니라면 차이는 미미합니다. 게다가, 저렇게나 성능이 요구되는 시스템이라면 애당초 서버 측에 "숫자 문자열"이 아닌, "숫자"로 데이터를 정정해서 보내달라고 하는 편이 더 효과를 거둘 수 있습니다.

(첨부 파일은 이 글의 예제 코드를 포함합니다.)




[이 글에 대해서 여러분들과 의견을 공유하고 싶습니다. 틀리거나 미흡한 부분 또는 의문 사항이 있으시면 언제든 댓글 남겨주십시오.]

[연관 글]






[최초 등록일: ]
[최종 수정일: 5/11/2022]

Creative Commons License
이 저작물은 크리에이티브 커먼즈 코리아 저작자표시-비영리-변경금지 2.0 대한민국 라이센스에 따라 이용하실 수 있습니다.
by SeongTae Jeong, mailto:techsharer at outlook.com

비밀번호

댓글 작성자
 



2022-05-11 09시41분
[차가워] 와우 고맙습니다.
서버단을 못 건드리는 상황에서 빠른 처리가 필요할때 정말 요긴합니다.
감사합니다.
[guest]
2022-05-11 10시06분
[차가워] 그런데 선생님 pc는 매우 빠르시네요.
저도 위의 코드를 돌려보니
77
17
나오네요.
제pc도 최신cpu인데 시간차 크네요.
[guest]
2022-05-11 10시20분
"인텔 코어i9-12세대 12900K"입니다. (별도 튜닝은 하지 않았습니다.)

2021년 새로운 PC
; https://www.sysnet.pe.kr/0/0/535

그나저나, 본문에서는 Debug 빌드로 한 것인데, Release 빌드로 돌리니 좀 더 빠르긴 하군요. ^^;

ConvertNormal : 33
ConvertToLong : 6
정성태
2022-05-11 11시16분
[차가워] 충격 !!
저도 12900K @5.2 고정
DDR4 3600 CL14

제가 두배 이상 늦네요.
문제가 뭘까요? ㅠㅠ
[guest]
2022-05-11 11시44분
[차가워] 선생님이랑 저랑 속도 차이가 심하게 나는데요.
혹시 avx 명령어랑 관련 있을가요?
[guest]
2022-05-12 09시13분
글쎄요, AVX 명령어라고 해도 어차피 JIT 컴파일러에서 그 명령어를 사용하도록 번역해야 하는데, 그런 환경이라면 @차가워 님이랑 별다를 바가 없을 듯합니다.

아마도, 보드 상에서 기본 적용된 CPU나 메모리의 최적화 변수가 다른 것이 아닐까요?
정성태
2022-05-12 07시17분
[차가워] 이상하네요.
12900k pc가 5대 있는데요. 5대 모두 테스트 해보니 연산 소요시간이 비슷하게 나옵니다.
12900k@5.4 ddr5@6000 cl28 이 pc가 73, 16으로 제일 잘 나옵니다.

 private void button4_Click(object sender, EventArgs e)
        {
            Main2();
        }

        void Main2()
        {
            Action<int, string, Func<byte[], long>, byte[]> action = (loopCount, title, work, arg) =>
            {
                Stopwatch st = new Stopwatch();
                st.Start();

                Random rand = new Random(Environment.TickCount);

                for (int i = 0; i < loopCount; i++)
                {
                    work(arg);
                }

                st.Stop();

                Console.WriteLine(title + " : " + st.ElapsedMilliseconds);
            };

            byte[] buf = Encoding.ASCII.GetBytes("1000000123");

            action(1, "touch-JIT", ConvertNormal, buf);
            action(1, "touch-JIT", ConvertToLong, buf);

            Console.WriteLine();

            action(1000000, "ConvertNormal", ConvertNormal, buf);
            action(1000000, "ConvertToLong", ConvertToLong, buf);
        }

        long ConvertNormal(byte[] bytes)
        {
            string tmp = Encoding.ASCII.GetString(bytes);
            return Convert.ToInt64(tmp);
        }

        long ConvertToLong(byte[] bytes)
        {
            long n = 1;
            long result = 0;

            for (int i = bytes.Length - 1; i >= 0; i--)
            {
                result = result + (bytes[i] - '0') * n;
                n *= 10;
            }

            return result;
        }
[guest]
2022-05-12 09시03분
@차가워 Release 빌드로 테스트 하신 거 맞나요? 제가 가진 "AMD Ryzen 7 PRO 4750G"로도 다음의 성능이 나옵니다.

ConvertNormal : 62
ConvertToLong : 9
정성태
2022-05-12 09시56분
[차가워] 12900k@5.4
ddr5@6000 cl28     
ASUS MAXIMUS Z690 EXTREME
e코어 전부 끔, 하이퍼스레딩 전부 끔

닷넷프레임워크 4.8
릴리즈모드, 64비트, 최적화체크
ConvertNormal : 67
ConvertToLong : 5

ConvertNormal 값이 선생님 보다 너무 안나오네요.
[guest]
2022-05-29 04시02분
[al6uiz] .NET Core, .NET 6이상을 사용한다면 Span과 Utf8Parser를 이용해도 성능은 비슷(아주 조금 느린)하지만 깔끔한 코드가 될 것 같네요.

private static long ConvertToLongSpan(byte[] bytes)
{
  Utf8Parser.TryParse(bytes.AsSpan(), out long value, out var count);
  return value;
}
[guest]
2022-05-29 11시09분
@al6uiz 그러게요, 제시하신 코드가 더 깔끔하군요. ^^
정성태

... 16  17  18  19  [20]  21  22  23  24  25  26  27  28  29  30  ...
NoWriterDateCnt.TitleFile(s)
13141정성태10/17/20227017.NET Framework: 2058. [in,out] 배열을 C#에서 C/C++로 넘기는 방법 - 세 번째 이야기파일 다운로드1
13140정성태10/11/20226338C/C++: 159. C/C++ - 리눅스 환경에서 u16string 문자열을 출력하는 방법 [2]
13139정성태10/9/20226130.NET Framework: 2057. 리눅스 환경의 .NET Core 3/5+ 메모리 덤프로부터 모든 닷넷 모듈을 추출하는 방법파일 다운로드1
13138정성태10/8/20227459.NET Framework: 2056. C# - await 비동기 호출을 기대한 메서드가 동기로 호출되었을 때의 부작용 [1]
13137정성태10/8/20225806.NET Framework: 2055. 리눅스 환경의 .NET Core 3/5+ 메모리 덤프로부터 닷넷 모듈을 추출하는 방법
13136정성태10/7/20226371.NET Framework: 2054. .NET Core/5+ SDK 설치 없이 dotnet-dump 사용하는 방법
13135정성태10/5/20226641.NET Framework: 2053. 리눅스 환경의 .NET Core 3/5+ 메모리 덤프를 분석하는 방법 - 두 번째 이야기
13134정성태10/4/20225353오류 유형: 820. There is a problem with AMD Radeon RX 5600 XT device. For more information, search for 'graphics device driver error code 31'
13133정성태10/4/20225697Windows: 211. Windows - (commit이 아닌) reserved 메모리 사용량 확인 방법 [1]
13132정성태10/3/20225609스크립트: 42. 파이썬 - latexify-py 패키지 소개 - 함수를 mathjax 식으로 표현
13131정성태10/3/20228375.NET Framework: 2052. C# - Windows Forms의 데이터 바인딩 지원(DataBinding, DataSource) [2]파일 다운로드1
13130정성태9/28/20225306.NET Framework: 2051. .NET Core/5+ - 에러 로깅을 위한 Middleware가 동작하지 않는 경우파일 다운로드1
13129정성태9/27/20225652.NET Framework: 2050. .NET Core를 IIS에서 호스팅하는 경우 .NET Framework CLR이 함께 로드되는 환경
13128정성태9/23/20228278C/C++: 158. Visual C++ - IDL 구문 중 "unsigned long"을 인식하지 못하는 #import파일 다운로드1
13127정성태9/22/20226776Windows: 210. WSL에 systemd 도입
13126정성태9/15/20227374.NET Framework: 2049. C# 11 - 정적 메서드에 대한 delegate 처리 시 cache 적용
13125정성태9/14/20227577.NET Framework: 2048. C# 11 - 구조체 필드의 자동 초기화(auto-default structs)
13124정성태9/13/20227347.NET Framework: 2047. Golang, Python, C#에서의 CRC32 사용
13123정성태9/8/20227762.NET Framework: 2046. C# 11 - 멤버(속성/필드)에 지정할 수 있는 required 예약어 추가
13122정성태8/26/20227667.NET Framework: 2045. C# 11 - 메서드 매개 변수에 대한 nameof 지원
13121정성태8/23/20225564C/C++: 157. Golang - 구조체의 slice 필드를 Reflection을 이용해 변경하는 방법
13120정성태8/19/20227125Windows: 209. Windows NT Service에서 UI를 다루는 방법 [3]
13119정성태8/18/20226685.NET Framework: 2044. .NET Core/5+ 프로젝트에서 참조 DLL이 보관된 공통 디렉터리를 지정하는 방법
13118정성태8/18/20225520.NET Framework: 2043. WPF Color의 기본 색 영역은 (sRGB가 아닌) scRGB [2]
13117정성태8/17/20227733.NET Framework: 2042. C# 11 - 파일 범위 내에서 유효한 타입 정의 (File-local types)파일 다운로드1
13116정성태8/4/20228198.NET Framework: 2041. C# - Socket.Close 시 Socket.Receive 메서드에서 예외가 발생하는 문제파일 다운로드1
... 16  17  18  19  [20]  21  22  23  24  25  26  27  28  29  30  ...