성태의 닷넷 이야기
홈 주인
모아 놓은 자료
프로그래밍
질문/답변
사용자 관리
사용자
메뉴
아티클
외부 아티클
유용한 코드
온라인 기능
MathJax 입력기
최근 덧글
[정성태] Java - How to use the Foreign Funct...
[정성태] 제가 큰 실수를 했군요. ^^; Delegate를 통한 Bein...
[정성태] Working with Rust Libraries from C#...
[정성태] Detecting blocking calls using asyn...
[정성태] 아쉽게도, 커뮤니티는 아니고 개인 블로그입니다. ^^
[정성태] 질문이 잘 이해가 안 됩니다. 우선, 해당 소스코드에서 ILis...
[양승조
] var대신 dinamic으로 선언해서 해결은 했습니다. 맞는 해...
[양승조
] 또 막혔습니다. ㅠㅠ var list = props[i].Ge...
[양승조
] 아. 감사합니다. 어제는 안됐던것 같은데....정신을 차려야겠네...
[정성태] "props[i].GetValue(props[i])" 코드에서 ...
글쓰기
제목
이름
암호
전자우편
HTML
홈페이지
유형
제니퍼 .NET
닷넷
COM 개체 관련
스크립트
VC++
VS.NET IDE
Windows
Team Foundation Server
디버깅 기술
오류 유형
개발 환경 구성
웹
기타
Linux
Java
DDK
Math
Phone
Graphics
사물인터넷
부모글 보이기/감추기
내용
<div style='display: inline'> <h1 style='font-family: Malgun Gothic, Consolas; font-size: 20pt; color: #006699; text-align: center; font-weight: bold'>System.IO.MemoryStream, ArraySegment<T> 의 효율적인 사용법</h1> <p> MemroyStream으로부터 바이트 스트림을 반환받을 수 있는 방법이 2가지입니다. 하나는 GetBuffer, 또 다른 하나는 ToArray인데요.<br /> <br /> 다음의 예제를 보면 대번에 그 차이점을 알 수 있습니다.<br /> <br /> <pre style='margin: 10px 0px 10px 10px; padding: 10px 0px 10px 10px; background-color: #fbedbb; overflow: auto; font-family: Consolas, Verdana;' > using System; using System.Text; using System.IO; namespace ConsoleApplication1 { class Program { static void Main(string[] args) { MemoryStream ms = new MemoryStream(); byte [] buf = Encoding.UTF8.GetBytes("hello"); ms.Write(buf, 0, buf.Length); byte[] getBuffer = <span style='color: blue; font-weight: bold'>ms.GetBuffer();</span> Console.WriteLine("GetBuffer.Length: " + getBuffer.Length); // <span style='color: blue; font-weight: bold'>256</span> byte[] toArray = <span style='color: blue; font-weight: bold'>ms.ToArray();</span> Console.WriteLine("ToArray.Length: " + toArray.Length); // <span style='color: blue; font-weight: bold'>5</span> } } } </pre> <br /> 보시는 바와 같이 GetBuffer는 블록으로 잡혀진 바이트 배열을 통째로 반환하는 반면 ToArray는 정확히 사용된 바이트 만큼의 배열을 반환합니다.<br /> <br /> 일단, 표면상으로 보면 ToArray를 사용하는 것이 좋습니다.<br /> <br /> <hr style='width: 50%' /><br /> <br /> 문제는, 데이터가 커지면서 발생합니다. 왜냐하면 2개의 메소드가 내부 구현방식이 다르기 때문입니다.<br /> <br /> <pre style='margin: 10px 0px 10px 10px; padding: 10px 0px 10px 10px; background-color: #fbedbb; overflow: auto; font-family: Consolas, Verdana;' > public virtual byte[] GetBuffer() // 내부에 이미 할당된 바이트 배열 변수를 그대로 반환 { if (!this._exposable) { throw new UnauthorizedAccessException(...); } <span style='color: blue; font-weight: bold'>return this._buffer;</span> } public virtual byte[] ToArray() // 새롭게 배열을 생성하고 내용을 복사해서 반환 { byte[] dst = <span style='color: blue; font-weight: bold'>new byte[this._length - this._origin];</span> Buffer.InternalBlockCopy(this._buffer, this._origin, dst, 0, this._length - this._origin); return dst; } </pre> <br /> 따라서, GC(Garbage Collector)입장에서는 ToArray가 부담스러운 메소드에 속합니다. 물론, 크기가 작으면 상관없지만 대개 바이트 스트림을 다루는 경우는 고용량 데이터를 다루는 경우가 많기 때문에 메모리 할당이 순간적으로 2배가 되는 것은 그다지 바람직하지 않습니다.<br /> <br /> 어디... 실제 사례를 통해 알아볼까요? ^^ 다음은 최근에 본 어느 업체의 GZIP 압축 코드입니다.<br /> <br /> <pre style='margin: 10px 0px 10px 10px; padding: 10px 0px 10px 10px; background-color: #fbedbb; overflow: auto; font-family: Consolas, Verdana;' > static ArraySegment<byte> CompressBuffer(ArraySegment<byte> buffer, BufferManager bufferManager, int messageOffset) { MemoryStream stream = new MemoryStream(); stream.Write(buffer.Array, 0, messageOffset); using (GZipStream stream2 = new GZipStream(stream, CompressionMode.Compress, true)) { stream2.Write(buffer.Array, messageOffset, buffer.Count); } <span style='color: blue; font-weight: bold'>byte[] sourceArray = stream.ToArray();</span> byte[] destinationArray = bufferManager.TakeBuffer(sourceArray.Length); Array.Copy(sourceArray, 0, destinationArray, 0, sourceArray.Length); bufferManager.ReturnBuffer(buffer.Array); return new ArraySegment<byte>(destinationArray, messageOffset, sourceArray.Length); } </pre> <br /> 위의 코드에서는 압축된 바이트 배열을 ToArray 로 받았는데, 따라서 50MB를 압축해서 25MB를 얻었으면 순간적으로 다시 25MB가 힙에 할당되는 것입니다. (사실, 이런 코드도 데스크톱 응용 프로그램에 쓰이면 별로 문제가 안 될 수 있는데, 위의 코드는 웹에서 사용된 것입니다.) 따라서, 이런 경우 GetBuffer를 이용해 다음과 같이 변환하는 것이 더 메모리 효율적인 코드가 나옵니다.<br /> <br /> <pre style='margin: 10px 0px 10px 10px; padding: 10px 0px 10px 10px; background-color: #fbedbb; overflow: auto; font-family: Consolas, Verdana;' > <span style='color: blue; font-weight: bold'>byte[] sourceArray = stream.GetBuffer();</span> int sourceLength = stream.Length; byte[] destinationArray = bufferManager.TakeBuffer(sourceLength); Array.Copy(sourceArray, 0, destinationArray, 0, sourceLength); </pre> <br /> GetBuffer를 이용해 MemoryStream 내부 버퍼를 이용하고, 실제 데이터 크기를 반환하는 Length 속성을 조합하면 ToArray를 사용했을 때의 부작용을 해결할 수 있습니다.<br /> <br /> 물론, GetBuffer에는 한 가지 치명적인 단점이 존재합니다. MemoryStream.Dispose를 호출한 이후에는 원본 바이트 배열이 해제되기 때문에 이후의 조작에서 예외가 발생합니다. 따라서, Stream이 닫히기 전에 임시로 데이터를 접근해야 할 때에만 GetBuffer를 사용하는 것이 좋습니다. 혹은 그런 부작용을 없애고 싶다면 MemoryStream은 명시적으로 닫지 말고 GC에 맡기는 방법이 있습니다.<br /> <br /> <hr style='width: 50%' /><br /> <br /> 문제는, GetBuffer로 반환받은 배열 변수를 이용하는 경우 에러를 유발할 수 있는 여지가 많다는 점입니다. MemoryStream.Length 속성을 반드시 사용해야 하는데도 불구하고 무심코 바이트 배열의 Length를 사용할 수 있습니다.<br /> <br /> ArraySegment<T>는 이런 문제를 자연스럽게 해결해 줍니다. 이름이 좀 낯설어서 그럴 뿐, ArraySegment는 원본 데이터에 대한 뷰(View)를 구현해주는 단순한 구조의 타입에 불과합니다. 예를 들어서, MemoryStream의 데이터를 로그에 남기는 메소드를 만든다고 가정해 보겠습니다.<br /> <br /> <pre style='margin: 10px 0px 10px 10px; padding: 10px 0px 10px 10px; background-color: #fbedbb; overflow: auto; font-family: Consolas, Verdana;' > byte[] getBuffer = ms.GetBuffer(); LogBytes(getBuffer, ms.Length); private static void LogBytes(byte[] buffer, long length) { for (long idx = 0; idx < length; idx++) { Console.Write(buffer[idx].ToString("x") + ", "); } Console.WriteLine(); } </pre> <br /> 언제나 2개의 변수를 전달해야 하는 불편함을, ArraySegment를 이용해 다음과 같이 해결할 수 있습니다. (물론, 그냥 MemoryStream을 넘겨도 되겠지만.)<br /> <br /> <pre style='margin: 10px 0px 10px 10px; padding: 10px 0px 10px 10px; background-color: #fbedbb; overflow: auto; font-family: Consolas, Verdana;' > byte[] getBuffer = ms.GetBuffer(); ArraySegment<byte> segment = new ArraySegment<byte>(getBuffer, 0, (int)ms.Length); LogBytes(segment); private static void LogBytes(ArraySegment<byte> segment) { for (long idx = 0; idx < segment.Count; idx++) { Console.Write(segment.Array[idx].ToString("x") + ", "); } Console.WriteLine(); } </pre> <br /> 알고 보면 ArraySegment도 별거 아니죠? ^^<br /> <br /> 자, 그럼 기준을 간단하게 정리해 보겠습니다. 소규모 데이터를 다룰 때면 편리하게 ToArray를 다뤄도 좋습니다. 반면, 대규모 데이터를 다뤄야 할 때면 반드시 GetBuffer에 대한 사용을 고려해야 합니다. 이도 저도 귀찮을 때는 무조건 GetBuffer + ArraySegment만을 전체적으로 사용하는 것이 좋겠고!<br /> </p><br /> <br /><hr /><span style='color: Maroon'>[이 글에 대해서 여러분들과 의견을 공유하고 싶습니다. 틀리거나 미흡한 부분 또는 의문 사항이 있으시면 언제든 댓글 남겨주십시오.]</span> </div>
첨부파일
스팸 방지용 인증 번호
1740
(왼쪽의 숫자를 입력해야 합니다.)