Microsoft가 Hugging Face 오픈 모델을 큐레이션해 Foundry Managed Compute에 원클릭 배포하는 'Hugging Face Models on Foundry'를 공개했다(프리뷰). 매주 갱신되는 컬렉션은 라이선스·보안 심사를 거친 SafeTensors 모델만 포함하며, 가중치는 Azure에 사전 적재되고 vLLM, SGLang, TensorRT-LLM, NIM, TEI, llama.cpp 등 Microsoft가 빌드·CVE 스캔한 런타임으로 서빙된다. 배포 템플릿이 런타임·가속기(A100/H100/MI300X)·컨텍스트 길이를 사전 튜닝해 제공하고, 단일 엔드포인트·동일 SDK·통합 과금으로 프런티어 모델과 같은 방식으로 에이전트에 연결된다. 오픈 모델 운영의 최대 난제였던 보안 심사·런타임 관리·GPU 사이징을 Microsoft가 대신 처리해 엔터프라이즈 도입 장벽을 낮춘 것이 핵심이다.
- •매주 갱신되는 큐레이션 컴렉션: 라이선스 심사 + trust_remote_code 배제 + SafeTensors 전용
- •vLLM·SGLang·TensorRT-LLM·NIM·TEI·llama.cpp 런타임을 Microsoft가 빌드·CVE 스캔·자동 패치
- •가중치가 Azure에 사전 적재돼 Hugging Face Hub 아웃바운드 연결 없이 프라이b54 네트워크 배포 가능
- •배포 템플릿이 런타임·가속기·컨텍스트 길이를 사전 튜닝(예: qwen3-32b용 4종 템플릿)
- •A100·H100·AMD MI300X 지원, Global·Data Zone 배포, OpenAI SDK 호환 단일 엔드포인트
0단 자동
AI가 규칙대로 쓰고 그대로 게시했습니다. 사람이 따로 보지 않았습니다.
- 규칙 판
- 규칙 판 도입 이전 기사입니다.
- 남기는 것
- 규칙 판 · 모델 · 시각
- 판 기록
- 아직 없습니다.
Hugging Face Models on Foundry Managed Compute

- 1.마이크로소프트, 허깅페이스 큐레이션 모델을 Foundry Managed Compute에 원클릭 배포 지원
- 2.주간 갱신 카탈로그: 라이선스·보안 심사, SafeTensors 전용, trust_remote_code 배제
- 3.vLLM·SGLang·TensorRT-LLM·TEI·llama.cpp 등 런타임을 모델별 매칭, CVE 패치 자동
- 4.가중치는 Azure에 사전 적재돼 프라이볳 네트워크 내 배포 가능, A100·H100·MI300X 지원
왜 중요한가?
오픈모델 도입의 최대 장벽이던 보안 심사·런타임 구축·GPU 사이징 등 운영 계층을 마이크로소프트가 대신 맡는 구조로, 오픈 웨이트 모델의 엔터프라이즈 채택 마찰을 크게 줄여 폐쇄형 API와의 경쟁 구도를 바꿀 수 있다.
전체 내용이 궁금하다면?
원문을 직접 읽어보세요
이 글이 만들어진 과정
- 01:53AI 초안

