Microsoft MVP성태의 닷넷 이야기
.NET Framework: 2107. .NET 6+ FileStream의 구조 변화 [링크 복사], [링크+제목 복사],
조회: 14360
글쓴 사람
정성태 (techsharer at outlook.com)
홈페이지
첨부 파일
 

.NET 6+ FileStream의 구조 변화

아래의 글에,

C# - byte * (바이트 포인터)를 FileStream으로 쓰는 방법
; https://www.sysnet.pe.kr/2/0/12913

다음과 같은 내용의 덧글이 있습니다.

corefx 구현체에서 Span 객체를 인자로 받는 Read/Write 메소드가 array pool을 활용하여 버퍼를 복사하고 다시 Read(byte[], int, int)와 Write(byte[], int, int)를 호출


시간이 좀 지났으니, 현재의 구현이 어떻게 되어 있는지 살펴보겠습니다. ^^




우선, FileStream의 Span을 받는 Write 메서드를 보면,

public override void Write(ReadOnlySpan<byte> buffer) => _strategy.Write(buffer);

호출을 _strategy로 전달하고 있습니다. 이 멤버는 FileStream 생성자에서 결정되는데요,

public FileStream(SafeFileHandle handle, FileAccess access, int bufferSize)
{
    ValidateHandle(handle, access, bufferSize);

    _strategy = FileStreamHelpers.ChooseStrategy(this, handle, access, bufferSize, handle.IsAsync);
}

FileStreamHelpers.ChooseStrategy는 다시,

namespace System.IO.Strategies
{
    internal static partial class FileStreamHelpers
    {
        // ...[생략]...

        internal static FileStreamStrategy ChooseStrategy(FileStream fileStream, SafeFileHandle handle, FileAccess access, int bufferSize, bool isAsync)
        {
            FileStreamStrategy strategy =
                EnableBufferingIfNeeded(ChooseStrategyCore(handle, access, isAsync), bufferSize);

            return WrapIfDerivedType(fileStream, strategy);
        }

        // ...[생략]...
    }
}

ChooseStrategyCore로 역할을 맡기고 있습니다. 여기서 재미있는 것은 FileStreamHelpers 자체가 partial class라는 점입니다. 이유는 짐작 가시죠? ^^

윈도우뿐만 아니라 리눅스 등도 지원해야 하기 때문에 FileStreamHelpers는 partial로 플랫폼에 따라 다른 파일을 포함해 빌드하게 됩니다. 일례로 윈도우의 경우 FileStreamHelpers.Windows.cs 파일을 포함하고, 그 파일의 ChooseStrategyCore를 보면,

private static FileStreamStrategy ChooseStrategyCore(string path, FileMode mode, FileAccess access, FileShare share, FileOptions options, long preallocationSize, UnixFileMode? unixCreateMode) =>
    (options & FileOptions.Asynchronous) != 0 ?
        new AsyncWindowsFileStreamStrategy(path, mode, access, share, options, preallocationSize, unixCreateMode) :
        new SyncWindowsFileStreamStrategy(path, mode, access, share, options, preallocationSize, unixCreateMode);

동기/비동기에 따라 다른 타입을 생성해 반환합니다. 2가지 중에 여기서는 SyncWindowsFileStreamStrategy.cs로 들어가 보겠습니다. ^^

using Microsoft.Win32.SafeHandles;

namespace System.IO.Strategies
{
    internal sealed class SyncWindowsFileStreamStrategy : OSFileStreamStrategy
    {
        internal SyncWindowsFileStreamStrategy(SafeFileHandle handle, FileAccess access) : base(handle, access)
        {
        }

        internal SyncWindowsFileStreamStrategy(string path, FileMode mode, FileAccess access, FileShare share, FileOptions options, long preallocationSize, UnixFileMode? unixCreateMode)
            : base(path, mode, access, share, options, preallocationSize, unixCreateMode)
        {
        }

        internal override bool IsAsync => false;
    }
}

partial이 아니므로 이번에는 대부분의 구현이 부모 클래스에 있을 텐데요, 정의를 가보면 Write 메서드의 본체를 볼 수 있습니다.

// OSFileStreamStrategy.cs

public sealed override void Write(ReadOnlySpan<byte> buffer)
{
    if (_fileHandle.IsClosed)
    {
        ThrowHelper.ThrowObjectDisposedException_FileClosed();
    }
    else if ((_access & FileAccess.Write) == 0)
    {
        ThrowHelper.ThrowNotSupportedException_UnwritableStream();
    }

    RandomAccess.WriteAtOffset(_fileHandle, buffer, _filePosition);
    _filePosition += buffer.Length;
}

아쉽게도 여기가 끝이 아니군요. ^^ RandomAccess.WriteAtOffset으로 인자를 그대로 전달하는데, 이것 역시 partial 클래스로,

// RandomAccess.cs

namespace System.IO
{
    public static partial class RandomAccess
    {
         // ...[생략]...
    }
}

빌드 시 대상 플랫폼에 따라 다른 소스코드 파일과 엮이게 됩니다. 윈도우의 경우는 RandomAccess.Windows.cs 파일이 포함되는데,

// RandomAccess.Windows.cs

namespace System.IO
{
    public static partial class RandomAccess
    {
        // ...[생략]...

        internal static unsafe void WriteAtOffset(SafeFileHandle handle, ReadOnlySpan<byte> buffer, long fileOffset)
        {
            // ...[생략]...

            NativeOverlapped overlapped = GetNativeOverlappedForSyncHandle(handle, fileOffset);
            fixed (byte* pinned = &MemoryMarshal.GetReference(buffer))
            {
                if (Interop.Kernel32.WriteFile(handle, pinned, buffer.Length, out int numBytesWritten, &overlapped) != 0)
                {
                    Debug.Assert(numBytesWritten == buffer.Length);
                    return;
                }

                int errorCode = FileStreamHelpers.GetLastWin32ErrorAndDisposeHandleIfInvalid(handle);
                throw Win32Marshal.GetExceptionForWin32Error(errorCode, handle.Path);
            }
        }
    }
}

보는 바와 같이 Kernel32.WriteFile Win32 API 호출을 바로 하고 있습니다. 즉, Span 인자로 넘긴 데이터의 복사는 발생하지 않으니 안심하고 사용하셔도 되겠습니다. ^^




시작은 Write 메서드의 버퍼 복사를 살펴보려는 것이었는데, 뜻하지 않게 다중 플랫폼 지원을 추가하느라 바뀐 FileStream의 구현을 들여다보게 되었습니다. 아울러, 아래의 문서를 보면,

File IO improvements in .NET 6
; https://devblogs.microsoft.com/dotnet/file-io-improvements-in-dotnet-6/

The increased amount of allocated memory comes from the abstraction layer that we have introduced to support the .NET 5 Compatibility mode, which also helped increase the code maintainability: we now have a few separate FileStream strategy implementations instead of one with a lot of if blocks.


.NET 5까지는 Span Write 메서드에 대해 Net5CompatFileStreamStrategy 소스코드에서 확인할 수 있는 것처럼, 버퍼 복사가 이뤄집니다.

// Net5CompatFileStreamStrategy.Windows.cs

private void WriteSpan(ReadOnlySpan<byte> source)
{
    // ...[생략]...

    if (_writePos > 0)
    {
        int numBytes = _bufferLength - _writePos;   // space left in buffer
        if (numBytes > 0)
        {
            if (numBytes >= source.Length)
            {
                source.CopyTo(GetBuffer().AsSpan(_writePos));
                _writePos += source.Length;
                return;
            }
            else
            {
                source.Slice(0, numBytes).CopyTo(GetBuffer().AsSpan(_writePos));
                _writePos += numBytes;
                source = source.Slice(numBytes);
            }
        }

        // ...[생략]...
    }

    // ...[생략]...

    // Copy remaining bytes into buffer, to write at a later date.
    source.CopyTo(GetBuffer().AsSpan(_writePos));
    _writePos = source.Length;
    return;
}

그러니까, .NET 6+로 업데이트하는 것만으로도 "File IO improvements in .NET 6" 문서의 내용대로 성능 향상을 볼 수 있습니다.




[이 글에 대해서 여러분들과 의견을 공유하고 싶습니다. 틀리거나 미흡한 부분 또는 의문 사항이 있으시면 언제든 댓글 남겨주십시오.]







[최초 등록일: ]
[최종 수정일: 4/5/2023]

Creative Commons License
이 저작물은 크리에이티브 커먼즈 코리아 저작자표시-비영리-변경금지 2.0 대한민국 라이센스에 따라 이용하실 수 있습니다.
by SeongTae Jeong, mailto:techsharer at outlook.com

비밀번호

댓글 작성자
 




... 61  62  63  64  65  66  67  68  69  70  71  72  73  74  [75]  ...
NoWriterDateCnt.TitleFile(s)
12097정성태1/2/202018881디버깅 기술: 150. windbg - Wow64, x86, x64에서의 커널 구조체(예: TEB) 구조체 확인
12096정성태12/30/201920882디버깅 기술: 149. C# - DbgEng.dll을 이용한 간단한 디버거 제작 [1]
12095정성태12/27/201923310VC++: 135. C++ - string_view의 동작 방식
12094정성태12/26/201921128.NET Framework: 873. C# - 코드를 통해 PDB 심벌 파일 다운로드 방법
12093정성태12/26/201920655.NET Framework: 872. C# - 로딩된 Native DLL의 export 함수 목록 출력파일 다운로드1
12092정성태12/25/201918759디버깅 기술: 148. cdb.exe를 이용해 (ntdll.dll 등에 정의된) 커널 구조체 출력하는 방법
12091정성태12/25/201921936디버깅 기술: 147. pdb 파일을 다운로드하기 위한 symchk.exe 실행에 필요한 최소 파일 [1]
12090정성태12/24/201921790.NET Framework: 871. .NET AnyCPU로 빌드된 PE 헤더의 로딩 전/후 차이점 [1]파일 다운로드1
12089정성태12/23/201920093디버깅 기술: 146. gflags와 _CrtIsMemoryBlock을 이용한 Heap 메모리 손상 여부 체크
12088정성태12/23/201919410Linux: 28. Linux - 윈도우의 "Run as different user" 기능을 shell에서 실행하는 방법
12087정성태12/21/201919715디버깅 기술: 145. windbg/sos - Dictionary의 entries 배열 내용을 모두 덤프하는 방법 (do_hashtable.py) [1]
12086정성태12/20/201922694디버깅 기술: 144. windbg - Marshal.FreeHGlobal에서 발생한 덤프 분석 사례
12085정성태12/20/201920712오류 유형: 586. iisreset - The data is invalid. (2147942413, 8007000d) 오류 발생 - 두 번째 이야기 [1]
12084정성태12/19/201920958디버깅 기술: 143. windbg/sos - Hashtable의 buckets 배열 내용을 모두 덤프하는 방법 (do_hashtable.py) [1]
12083정성태12/17/201923731Linux: 27. linux - lldb를 이용한 .NET Core 응용 프로그램의 메모리 덤프 분석 방법 [2]
12082정성태12/17/201922166오류 유형: 585. lsof: WARNING: can't stat() fuse.gvfsd-fuse file system
12081정성태12/16/201924247개발 환경 구성: 465. 로컬 PC에서 개발 중인 ASP.NET Core 웹 응용 프로그램을 다른 PC에서도 접근하는 방법 [5]
12080정성태12/16/201920875.NET Framework: 870. C# - 프로세스의 모든 핸들을 열람
12079정성태12/13/201923336오류 유형: 584. 원격 데스크톱(rdp) 환경에서 다중 또는 고용량 파일 복사 시 "Unspecified error" 오류 발생
12078정성태12/13/201923079Linux: 26. .NET Core 응용 프로그램을 위한 메모리 덤프 방법 [3]
12077정성태12/13/201921406Linux: 25. 자주 실행할 명령어 또는 초기 환경을 "~/.bashrc" 파일에 등록
12076정성태12/12/201920576디버깅 기술: 142. Linux - lldb 환경에서 sos 확장 명령어를 이용한 닷넷 프로세스 디버깅 - 배포 방법에 따른 차이
12075정성태12/11/201921406디버깅 기술: 141. Linux - lldb 환경에서 sos 확장 명령어를 이용한 닷넷 프로세스 디버깅
12074정성태12/10/201921080디버깅 기술: 140. windbg/Visual Studio - 값이 변경된 경우를 위한 정지점(BP) 설정(Data Breakpoint)
12073정성태12/10/201921886Linux: 24. Linux/C# - 실행 파일이 아닌 스크립트 형식의 명령어를 Process.Start로 실행하는 방법
12072정성태12/9/201918605오류 유형: 583. iisreset 수행 시 "No such interface supported" 오류
... 61  62  63  64  65  66  67  68  69  70  71  72  73  74  [75]  ...