Microsoft MVP성태의 닷넷 이야기
닷넷: 2353. C# - Foundry Local을 이용한 gpt-oss-20b 모델 사용 [링크 복사], [링크+제목 복사],
조회: 938
글쓴 사람
정성태 (seongtaejeong at gmail.com)
홈페이지
첨부 파일

(시리즈 글이 6개 있습니다.)
개발 환경 구성: 748. Windows + Foundry Local - 로컬에서 AI 모델 활용
; https://www.sysnet.pe.kr/2/0/13943

닷넷: 2337. C# - Hugging Face에 공개된 LLM 모델을 Foundry Local에서 사용하는 방법
; https://www.sysnet.pe.kr/2/0/13954

닷넷: 2338. C# / Foundry Local - Phi-4-multimodal 모델을 사용하는 방법
; https://www.sysnet.pe.kr/2/0/13957

닷넷: 2339. C# - Phi-4-multimodal 모델의 GPU 가속 방법 (ORT 사용)
; https://www.sysnet.pe.kr/2/0/13958

닷넷: 2348. C# - 카카오 카나나 모델 + Microsoft.ML.OnnxRuntimeGenAI 예제
; https://www.sysnet.pe.kr/2/0/13976

닷넷: 2353. C# - Foundry Local을 이용한 gpt-oss-20b 모델 사용
; https://www.sysnet.pe.kr/2/0/13992




C# - Foundry Local을 이용한 gpt-oss-20b 모델 사용

오호~~~ 최근 OpenAI에서 GPT OSS 20B 모델을 공개했는데요, Hugging Face에도 올라온 상태입니다.

openai/gpt-oss-20b
; https://huggingface.co/openai/gpt-oss-20b/blob/main/config.json

아쉽게도 "GptOssForCausalLM" 구조라 olive를 이용한 ONNX 포맷으로의 전환이 안 되는 유형이었는데, 마이크로소프트에서 발 빠르게 이것을 Foundry Local에 기본 지원 모델로 포함시켰기 때문에,

Available today: gpt-oss-20B Model on Windows with GPU Acceleration – further pushing the boundaries on the edge
; https://blogs.windows.com/windowsdeveloper/2025/08/05/available-today-gpt-oss-20b-model-on-windows-with-gpu-acceleration-further-pushing-the-boundaries-on-the-edge/

지난 글에서 설명한 방법대로 C#에서도 손쉽게 접근할 수 있습니다.

Windows + Foundry Local - 로컬에서 AI 모델 활용
; https://www.sysnet.pe.kr/2/0/13943




그래도 한번 실습을 해볼까요? ^^ 일단 olive 변환은 할 수 없으니, Foundry Local을 이용해 다음과 같이 다운로드할 수 있습니다.

C:\temp> foundry model download gpt-oss-20B
Downloading gpt-oss-20b-cuda-gpu...
[####################################] 100.00 % [Time remaining: about 0s]        36.9 MB/s
Tips:
- To find model cache location use: foundry cache location
- To find models already downloaded use: foundry cache ls

이후 OpenAI 패키지로 Foundry Local과 연동해 이런 식으로 코딩할 수 있습니다.

using OpenAI;
using OpenAI.Chat;
using System.ClientModel;

namespace ConsoleApp1;

internal class Program
{
    // Install-Package OpenAI 
    static void Main(string[] args)
    {
        string ep = "http://localhost:5273/v1";
        string key = "OPENAI_API_KEY";
        string alias = "gpt-oss-20b-cuda-gpu";

        OpenAIClientOptions options = new OpenAIClientOptions();
        options.Endpoint = new Uri(ep);

        ApiKeyCredential akc = new ApiKeyCredential(key);
        ChatClient client = new(alias, akc, options);

        ChatCompletion completion = client.CompleteChat("하늘이 파란 이유는?'");

        foreach (var message in completion.Content)
        {
            Console.WriteLine($"[{message.Kind}]: {message.Text}");
        }
    }
}

/* 실행 결과:

[Text]: <|channel|>analysis<|message|>The user says: "하늘이 파란 이유는?" in Korean, which translates to "The reason why the sky is blue?" The question is likely about the reason behind Rayleigh scattering, color of sky because of scattering of shorter wavelengths of visible light off atmosphere, etc.

We need to respond. The user didn't give any context besides asking. They just say in Korean: "The reason the sky is blue?" So answer: It's due to Rayleigh scattering causing blue light to be scattered more.

We can provide explanation: solar light: white, but Earth's atmosphere scatters more of blue wavelengths, causing blue sky.

So just answer like: "태양빛이 투과하면서 대기 중 분자와 아주 작은 입자에 의해 산란된 파장에서 가장 짧은 파장이 산란이 가장 잘 일어나므로..." or we can keep simple.

We can also mention the "Huygens–Fresnel principle" or "Mie scattering
*/

참고로, 모델 용량이 11GB 정도여서 그런지 초기 로딩 시간이 꽤 걸리는군요. ^^

(첨부 파일은 이 글의 예제 코드를 포함합니다.)




Foundry Local을 통해 다운로드한 모델의 경우 .\Microsoft\gpt-oss-20b-cuda-gpu\v1 디렉터리에 genai_config.json 파일이 함께 있습니다. 아하... 그렇다면 Microsoft.ML.OnnxRuntimeGenAI 패키지를 이용하는 것도 가능하다는 의미일 텐데요,

using Microsoft.ML.OnnxRuntimeGenAI;
using System.Reflection;
using System.Reflection.Emit;

namespace ConsoleApp2;

internal class Program
{
    // Install-Package Microsoft.ML.OnnxRuntimeGenAI.CUDA

    static void Main(string[] args)
    {
        // cuDNN 필요
        string? path = Environment.GetEnvironmentVariable("PATH");
        path += @";C:\Program Files\NVIDIA\CUDNN\v9.10\bin\12.9";
        Environment.SetEnvironmentVariable("PATH", path);

        string modelPath = @"C:\foundry_cache\Microsoft\gpt-oss-20b-cuda-gpu\v1";

        Console.Write("Loading model from " + modelPath + "...");
        using Model model = new(modelPath);
        Console.Write("Done\n");
        using Tokenizer tokenizer = new(model);
        using TokenizerStream tokenizerStream = tokenizer.CreateStream();

        while (true)
        {
            Console.Write("User:");

            string prompt = "<|im_start|>user\n" +
                            Console.ReadLine() +
                            "<|im_end|>\n<|im_start|>assistant\n";
            var sequences = tokenizer.Encode(prompt);

            using GeneratorParams gParams = new GeneratorParams(model);
            gParams.SetSearchOption("max_length", 2400);
            using Generator generator = new(model, gParams);
            generator.AppendTokenSequences(sequences);

            Console.Out.Write("\nAI:");
            while (!generator.IsDone())
            {
                generator.GenerateNextToken();
                var token = generator.GetSequence(0)[^1];
                Console.Out.Write(tokenizerStream.Decode(token));
                Console.Out.Flush();
            }
            Console.WriteLine();
        }
    }
}

아쉽게도 실행해 보면 이런 오류가 발생합니다.

Loading model from C:\foundry_cache\Microsoft\gpt-oss-20b-cuda-gpu\v1...Unhandled exception. Microsoft.ML.OnnxRuntimeGenAI.OnnxRuntimeGenAIException: Load model from E:\foundry_cache\Microsoft\gpt-oss-20b-cuda-gpu\v1\model.onnx failed:This is an invalid model. In Node, ("/model/layers.0/attn/GroupQueryAttention", GroupQueryAttention, "com.microsoft", -1) : ("/model/layers.0/attn/qkv_proj/Add/output_0": tensor(float16),"","","past_key_values.0.key": tensor(float16),"past_key_values.0.value": tensor(float16),"/model/attn_mask_reformat/attn_mask_subgraph/Sub/Cast/output_0": tensor(int32),"/model/attn_mask_reformat/attn_mask_subgraph/Gather/Cast/output_0": tensor(int32),"cos_cache": tensor(float16),"sin_cache": tensor(float16),"","","model.layers.0.attn.sinks": tensor(float16),) -> ("/model/layers.0/attn/GroupQueryAttention/output_0": tensor(float16),"present.0.key": tensor(float16),"present.0.value": tensor(float16),) , Error Node(/model/layers.0/attn/GroupQueryAttention) with schema(com.microsoft::GroupQueryAttention:1) has input size 12 not in range [min=7, max=11].
at Microsoft.ML.OnnxRuntimeGenAI.Model..ctor(String modelPath)
at ConsoleApp2.Program.Main(String[] args)


음... 아마도 Microsoft.ML.OnnxRuntimeGenAI 패키지가 업데이트되기를 기다려야 할 것 같습니다. ^^ (기록을 보니까 불과 5일 전에 0.9.0 업데이트가 되었는데 그 버전이 안 됩니다.)




혹시나 Foundry Local에서 gpt-oss-20B 모델을 찾지 못한다고 나오면?

C:\foundry_cache> foundry model run gpt-oss-20B
Exception: Model gpt-oss-20B not found

지난 버전의 Foundry Local을 사용하고 있는 경우인데요, 최신 버전으로 업데이트하면 됩니다.




[이 글에 대해서 여러분들과 의견을 공유하고 싶습니다. 틀리거나 미흡한 부분 또는 의문 사항이 있으시면 언제든 댓글 남겨주십시오.]







[최초 등록일: ]
[최종 수정일: 8/12/2025]

Creative Commons License
이 저작물은 크리에이티브 커먼즈 코리아 저작자표시-비영리-변경금지 2.0 대한민국 라이센스에 따라 이용하실 수 있습니다.
by SeongTae Jeong, mailto:techsharer at outlook.com

비밀번호

댓글 작성자
 




... 106  107  108  109  [110]  111  112  113  114  115  116  117  118  119  120  ...
NoWriterDateCnt.TitleFile(s)
11251정성태7/13/201720358디버깅 기술: 88. windbg 분석 - webengine4.dll의 MgdExplicitFlush에서 발생한 System.AccessViolationException의 crash 문제 (2)
11250정성태7/13/201724168디버깅 기술: 87. windbg 분석 - webengine4.dll의 MgdExplicitFlush에서 발생한 System.AccessViolationException의 crash 문제 [1]
11249정성태7/12/201721555오류 유형: 410. LoadLibrary("[...].dll") failed - The specified procedure could not be found.
11248정성태7/12/201728142오류 유형: 409. pip install pefile - 'cp949' codec can't decode byte 0xe2 in position 208687: illegal multibyte sequence
11247정성태7/12/201722531오류 유형: 408. SqlConnection 객체 생성 시 무한 대기 문제파일 다운로드1
11246정성태7/11/201719752VS.NET IDE: 118. Visual Studio - 다중 폴더에 포함된 파일들에 대한 "Copy to Output Directory"를 한 번에 설정하는 방법
11245정성태7/10/201725591개발 환경 구성: 321. Visual Studio Emulator for Android 소개 [2]
11244정성태7/10/201726720오류 유형: 407. Visual Studio에서 ASP.NET Core 실행할 때 dotnet.exe 프로세스의 -532462766 오류 발생 [1]
11243정성태7/10/201723527.NET Framework: 666. dotnet.exe - 윈도우 운영체제에서의 .NET Core 버전 찾기 규칙
11242정성태7/8/201722290제니퍼 .NET: 27. 제니퍼 닷넷 적용 사례 (7) - 노후된 스토리지 장비로 인한 웹 서비스 Hang (멈춤) 현상
11241정성태7/8/201720773오류 유형: 406. Xamarin 빌드 에러 XA5209, APT0000
11240정성태7/7/201725356.NET Framework: 665. ClickOnce를 웹 브라우저를 이용하지 않고 쿼리 문자열을 전달하면서 실행하는 방법 [3]파일 다운로드1
11239정성태7/6/201725170.NET Framework: 664. Protocol Handler - 웹 브라우저에서 데스크톱 응용 프로그램을 실행하는 방법 [5]파일 다운로드1
11238정성태7/6/201722648오류 유형: 405. NT 서비스 시작 시 "Error 1067: The process terminated unexpectedly." 오류 발생 [2]
11237정성태7/5/201724507.NET Framework: 663. C# - PDB 파일 경로를 PE 파일로부터 얻는 방법파일 다운로드1
11236정성태7/4/201728284.NET Framework: 662. C# - VHD/VHDX 가상 디스크를 마운트하지 않고 파일을 복사하는 방법파일 다운로드1
11235정성태6/29/201722794Math: 20. Matlab/Octave로 Gram-Schmidt 정규 직교 집합 구하는 방법
11234정성태6/29/201720815오류 유형: 404. SharePoint 2013 설치 과정에서 "The username is invalid The account must be a valid domain account" 오류 발생
11233정성태6/28/201720681오류 유형: 403. SharePoint Server 2013을 Windows Server 2016에 설치할 때 .NET 4.5 설치 오류 발생
11232정성태6/28/201721506Windows: 144. Windows Server 2016에 Windows Identity Extensions을 설치하는 방법
11231정성태6/28/201720471디버깅 기술: 86. windbg의 mscordacwks DLL 로드 문제 - 세 번째 이야기 [1]
11230정성태6/28/201720073제니퍼 .NET: 26. 제니퍼 닷넷 적용 사례 (6) - 잦은 Recycle 문제
11229정성태6/27/201721867오류 유형: 402. Windows Server Backup 관리 콘솔이 없어진 경우
11228정성태6/26/201718506개발 환경 구성: 320. Visual Basic .NET 프로젝트에서 내장 Manifest 자원을 EXE 파일로부터 제거하는 방법파일 다운로드1
11227정성태6/19/201728080개발 환경 구성: 319. windbg에서 python 스크립트 실행하는 방법 - pykd [6]
11226정성태6/19/201718098오류 유형: 401. Microsoft Edge를 실행했는데 입력 반응이 없는 경우
... 106  107  108  109  [110]  111  112  113  114  115  116  117  118  119  120  ...