Microsoft MVP성태의 닷넷 이야기
.NET Framework: 759. C# - System.Span<T> 성능 [링크 복사], [링크+제목 복사],
조회: 27970
글쓴 사람
정성태 (techsharer at outlook.com)
홈페이지
첨부 파일
 
(연관된 글이 2개 있습니다.)
(시리즈 글이 5개 있습니다.)
.NET Framework: 759. C# - System.Span<T> 성능
; https://www.sysnet.pe.kr/2/0/11535

.NET Framework: 768. BenchmarkDotNet으로 Span<T> 성능 측정
; https://www.sysnet.pe.kr/2/0/11550

.NET Framework: 995. C# - Span<T>와 Memory<T>
; https://www.sysnet.pe.kr/2/0/12475

.NET Framework: 1002. C# - ReadOnlySequence<T> 소개
; https://www.sysnet.pe.kr/2/0/12484

.NET Framework: 1112. C# - .NET 6부터 공개된 ISpanFormattable 사용법
; https://www.sysnet.pe.kr/2/0/12821




C# - System.Span<T> 성능

지난 글에서 설명한,

C# 7.2 - Span<T>
; https://www.sysnet.pe.kr/2/0/11534

Span<T>의 재미있는 점이 바로 성능입니다. 비관리 메모리에 대한 뷰를 제공하면서도 성능 손실이 거의 없도록 만들어졌다는 특징이 있는데요, 이에 대해 "C# - All About Span: Exploring a New .NET Mainstay" 글에서 .NET Runtime이 Span을 특별히 대우해 효율적인 기계어 코드를 생성하는 것에 대한 설명이 실려 있습니다.

그럼 테스트를 해볼까요? ^^

.NET Framework 4.7.2 + NuGet System.Memory + Release로 구성한 프로젝트에서 다음의 코드를,

using System;
using System.Diagnostics;

namespace ConsoleApp1
{
    class Program
    {
        static void Main(string[] args)
        {
            Action<int, string, Action<byte[]>, byte[]> action = (loopCount, title, work, arg) =>
            {
                Stopwatch st = new Stopwatch();
                st.Start();

                Random rand = new Random(Environment.TickCount);

                for (int i = 0; i < loopCount; i++)
                {
                    work(arg);
                }

                st.Stop();

                Console.WriteLine(title + " : " + st.ElapsedMilliseconds);
            };

            byte[] buf = new byte[1];

            action(1, "touch-JIT", ForLoop, buf);
            action(1, "touch-JIT", SpanLoop, buf);
            action(1, "touch-JIT", PtrLoop, buf);

            Console.WriteLine();

            buf = new byte[10000];
            action(100000, "ForLoop", ForLoop, buf);
            action(100000, "SpanLoop", SpanLoop, buf);
            action(100000, "PtrLoop", PtrLoop, buf);
        }

        static void ForLoop(byte[] buffer)
        {
            int sum = 0;

            for (int i = 0; i < buffer.Length; i++)
            {
                sum += buffer[i];
            }
        }

        static void SpanLoop(byte[] buffer)
        {
            Span<byte> span = buffer;
            int sum = 0;
            for (int i = 0; i < span.Length; i++)
            {
                sum += span[i];
            }
        }

        static unsafe void PtrLoop(byte[] buffer)
        {
            int sum = 0;
            fixed (byte* ptr = buffer)
            {
                for (int i = 0; i < buffer.Length; i++)
                {
                    sum += *(ptr + i);
                }
            }
        }
    }
}

3회 수행하면 결과가 대략 이렇게 나옵니다.

[.NET Framework 4.7.2 + NuGet System.Memory - Release]

ForLoop : 439
SpanLoop : 1311
PtrLoop : 408

ForLoop : 420
SpanLoop : 1237
PtrLoop : 398

ForLoop : 428
SpanLoop : 1253
PtrLoop : 424

아니, 빠르다면서요? 이게 어떻게 된 일입니까? 왜냐하면 아직 .NET Framework 4.7.2의 Runtime에는 Span 타입을 위한 최적화 코드가 들어가 있지 않기 때문입니다. 그냥 기존 런타임에 Span 타입을 담은 어셈블리로 테스트한 것에 불과하고 indexer 프로퍼티로 접근하는 부가 동작 때문에 더 느리게 됩니다.




반면 동일한 코드를 .NET Core 2.1 런타임에서 수행하면,

Announcing .NET Core 2.1
; https://devblogs.microsoft.com/dotnet/announcing-net-core-2-1/

결과가 달라집니다. (현재 15.7.3 기준으로) Visual Studio 2017에서 실습하려면 .NET Core 2.1 SDK를 다운로드해야 합니다.

.NET Core 2.1 SDK - x64/x86
; https://www.microsoft.com/net/download/windows

설치 후 .NET Core 프로젝트의 설정 창에서 다음과 같이 2.1로 변경하고,

span_core_1.png

위에서 테스트한 Span 코드를 동일하게 수행하면 3회 수행 시 다음과 같습니다.

[.NET Core 2.1 - Release]

ForLoop : 463
SpanLoop : 439
PtrLoop : 594

ForLoop : 456
SpanLoop : 440
PtrLoop : 593

ForLoop : 479
SpanLoop : 440
PtrLoop : 593

미세하지만 빠르기까지 한데요, 어쨌든 "뷰"를 제공함에도 불구하고 성능 손실이 없어졌습니다. 따라서 이런 성능과 함께 관리 힙 메모리 할당을 줄이는 코드를 점차 적용한다면 기존 응용 프로그램의 성능을 좀 더 높일 수 있게 될 것입니다.

실제로 .NET Core 2.1의 BCL에는 Span 등의 사용을 통해 성능 개선을 했다는 내용을 다음의 글에서 소개하고 있습니다.

Performance Improvements in .NET Core 2.1
; https://devblogs.microsoft.com/dotnet/performance-improvements-in-net-core-2-1/




참고로, .NET Core 2.0 응용 프로그램을 빌드/배포하는 경우 생성되는 System.Private.CoreLib.dll을 보면 Span 타입이 public으로 구현되어 있지만 mscorlib.dll에서 [assembly: TypeForwardedTo(typeof(...))]로 노출되어 있지 않기 때문에 사용할 수가 없습니다.

대신, Reflection을 이용하면 System.Span을 구할 수는 있습니다.

using System;
using System.Reflection;

class Program
{
    static void Main(string[] args)
    {
        Assembly asm = Assembly.GetAssembly(typeof(Activator));
        Console.WriteLine(asm.FullName);

        foreach (Type type in asm.GetTypes())
        {
            if (type.FullName == "System.Span`1")
            {
                Console.WriteLine("System.Span<T>: Found");
                return;
            }
        }

        {
            // CS0246 The type or namespace name 'Span<>' could not be found (are you missing a using directive or an assembly reference?)
            // Span<byte> t;
        }
    }
}

또한 .NET Framework + NuGet System.Memory 4.0.1.0으로 테스트한 결과가 느린 것에는 Span 타입의 구현이 코드 호환을 위해 구색만 맞춘 탓도 있습니다.

[StructLayout(LayoutKind.Sequential), IsByRefLike, Obsolete("Types with embedded references are not supported in this version of your compiler.", true), IsReadOnly, DebuggerTypeProxy((Type) typeof(SpanDebugView<>)), DebuggerDisplay("{ToString(),raw}"), DebuggerTypeProxy((Type) typeof(SpanDebugView<>)), DebuggerDisplay("{ToString(),raw}")]
public struct Span<T>
{
    private readonly Pinnable<T> _pinnable;
    private readonly IntPtr _byteOffset;
    private readonly int _length;
    public int Length { get; }

    ...[생략]... 
}

반면, ".NET Core 2.1의 "System.Private.CoreLib.dll"에는 "C# - All About Span: Exploring a New .NET Mainstay" 글에서 소개한 대로 정확하게 "제네릭 인자의 참조" 타입으로 구현하고 있습니다.

[StructLayout(LayoutKind.Sequential), IsByRefLike, NonVersionable, DebuggerDisplay("{ToString(),raw}"), DebuggerTypeProxy(typeof(SpanDebugView<>)), Obsolete("Types with embedded references are not supported in this version of your compiler.", true), DebuggerTypeProxy(typeof(SpanDebugView<>)), IsReadOnly, DebuggerDisplay("{ToString(),raw}")]
public struct Span<T>
{
    internal readonly ByReference<T> _pointer;
    private readonly int _length;
    public int Length { [NonVersionable] get; }

    ...[생략]... 
}
 

[StructLayout(LayoutKind.Sequential), IsByRefLike, NonVersionable, Obsolete("Types with embedded references are not supported in this version of your compiler.", true)]
internal struct ByReference<T>
{
    private IntPtr _value;
    public ByReference(ref T value);
    public ref T Value { get; }
}




[이 글에 대해서 여러분들과 의견을 공유하고 싶습니다. 틀리거나 미흡한 부분 또는 의문 사항이 있으시면 언제든 댓글 남겨주십시오.]

[연관 글]






[최초 등록일: ]
[최종 수정일: 7/13/2021]

Creative Commons License
이 저작물은 크리에이티브 커먼즈 코리아 저작자표시-비영리-변경금지 2.0 대한민국 라이센스에 따라 이용하실 수 있습니다.
by SeongTae Jeong, mailto:techsharer at outlook.com

비밀번호

댓글 작성자
 



2018-06-13 02시38분
BenchmarkDotNet으로 Span<T> 성능 측정
; http://www.sysnet.pe.kr/2/0/11550

C# Array and List Fastest Loop in 2024
; https://blog.ndepend.com/c-array-and-list-fastest-loop/
정성태

... 106  107  [108]  109  110  111  112  113  114  115  116  117  118  119  120  ...
NoWriterDateCnt.TitleFile(s)
11315정성태9/29/201744045기타: 68. "시작하세요! C# 6.0 프로그래밍: 기본 문법부터 실전 예제까지" 구매하신 분들을 위한 C# 7.0/7.1 추가 문법 PDF [8]
11314정성태9/28/201724964디버깅 기술: 98. windbg - 덤프 파일로부터 닷넷 버전 확인하는 방법
11313정성태9/25/201723457디버깅 기술: 97. windbg - 메모리 덤프로부터 DateTime 형식의 값을 알아내는 방법파일 다운로드1
11312정성태9/25/201726918.NET Framework: 685. C# - 구조체(값 형식)의 필드를 리플렉션을 이용해 값을 바꾸는 방법파일 다운로드1
11311정성태9/20/201718956.NET Framework: 684. System.Diagnostics.Process 객체의 명시적인 해제 권장
11310정성태9/19/201724805.NET Framework: 683. WPF의 Window 객체를 생성했는데 GC 수집 대상이 안 되는 이유 [3]
11309정성태9/13/201721412개발 환경 구성: 335. Octave의 명령 창에서 실행한 결과를 복사하는 방법
11308정성태9/13/201723572VS.NET IDE: 121. 비주얼 스튜디오에서 일부 텍스트 파일을 무조건 메모장으로만 여는 문제파일 다운로드1
11307정성태9/13/201726397오류 유형: 421. System.Runtime.InteropServices.SEHException - 0x80004005
11306정성태9/12/201724448.NET Framework: 682. 아웃룩 사용자를 위한 중국어 스팸 필터 Add-in
11305정성태9/12/201725686개발 환경 구성: 334. 기존 프로젝트를 Visual Studio를 이용해 Github의 신규 생성된 repo에 올리는 방법 [1]
11304정성태9/11/201722310개발 환경 구성: 333. 3ds Max를 Hyper-V VM에서 실행하는 방법
11303정성태9/11/201726469개발 환경 구성: 332. Inno Setup 파일의 관리자 권한을 제거하는 방법
11302정성태9/11/201722031개발 환경 구성: 331. SQL Server Express를 위한 방화벽 설정
11301정성태9/11/201720023오류 유형: 420. SQL Server Express 연결 오류 - A network-related or instance-specific error occurred while establishing a connection to SQL Server.
11300정성태9/10/201725692.NET Framework: 681. dotnet.exe - run, exec, build, restore, publish 차이점 [3]
11299정성태9/9/201724116개발 환경 구성: 330. Hyper-V VM의 Internal Network를 Private 유형으로 만드는 방법
11298정성태9/8/201727731VC++: 119. EnumProcesses / EnumProcessModules API 사용 시 주의점 [1]
11297정성태9/8/201724306디버깅 기술: 96. windbg - 풀 덤프에 포함된 모든 닷넷 모듈을 파일로 저장하는 방법
11296정성태9/8/201725869웹: 36. Edge - "이 웹 사이트는 이전 기술에서 실행되며 Internet Explorer에서만 작동합니다." 끄는 방법
11295정성태9/7/201724773디버깅 기술: 95. Windbg - .foreach 사용법
11294정성태9/4/201723884개발 환경 구성: 329. 마이크로소프트의 CoreCLR 프로파일러 예제 빌드 방법 [1]
11293정성태9/4/201725252개발 환경 구성: 328. Visual Studio(devenv.exe)를 배치 파일(.bat)을 통해 실행하는 방법
11292정성태9/4/201723483오류 유형: 419. Cannot connect to WMI provider - Invalid class [0x80041010]
11291정성태9/3/201723591개발 환경 구성: 327. 아파치 서버 2.4를 위한 mod_aspdotnet 마이그레이션
11290정성태9/3/201728062개발 환경 구성: 326. 아파치 서버에서 ASP.NET을 실행하는 mod_aspdotnet 모듈 [2]
... 106  107  [108]  109  110  111  112  113  114  115  116  117  118  119  120  ...