본문 바로가기
문서 목차
QKS클러스터

클러스터 생성

QKS에서 클러스터를 생성하면 컨트롤 플레인과 워커 노드가 자동으로 프로비저닝됩니다. 일반적으로 3 10분 내에 사용 가능한 상태가 됩니다.

QUANTUM C&S

개요

QKS에서 클러스터를 생성하면 컨트롤 플레인과 워커 노드가 자동으로 프로비저닝됩니다. 일반적으로 3~10분 내에 사용 가능한 상태가 됩니다.


생성 절차

클러스터 목록에서 클러스터 생성 버튼을 클릭하면 4단계 마법사가 열립니다.

1단계: 기본 정보

항목 설명 규칙
클러스터 이름 클러스터 식별자 2~56자. 영문 소문자 · 숫자 · 하이픈만 사용하며, 첫 글자와 마지막 글자는 영문 소문자 또는 숫자여야 합니다.
표시 이름 콘솔에 표시되는 이름 자유 입력
Kubernetes 버전 사용할 K8s 버전 v1.33.10 / v1.34.6 / v1.35.3 / v1.36.1 중 선택

참고

이름은 입력하는 즉시 중복 여부와 형식이 검사됩니다. 최대 56자인 이유는 클러스터마다 tenant-<이름> 네임스페이스가 만들어지고, 네임스페이스 이름이 63자로 제한되기 때문입니다.

2단계: 노드 설정

노드 풀 단위로 워커 노드의 사양과 개수를 지정합니다. 노드 풀은 여러 개 추가할 수 있습니다.

항목 설명
노드 풀 이름 영문 소문자 · 숫자 · 하이픈. 기본값은 default-pool
노드 타입 아래 프리셋 중 선택 (직접 입력이 아닌 카드 선택)
노드 수 워커 노드의 수 (1~10) — 생성 시 한도. 생성 후에는 노드 풀 스케일로 최대 100까지 늘릴 수 있습니다.
노드당 디스크 루트 디스크 크기 (10~500 GB, 기본 100 GB / GPU 노드 풀 기본 200 GB)

CPU 노드 타입

타입 vCPU 메모리
Small 2 4 GiB
Medium (기본) 4 8 GiB
Large 8 16 GiB
XLarge 16 32 GiB

GPU 노드 풀로 만들려면 GPU 타입을 선택합니다. GPU 타입을 고르면 vCPU와 메모리가 타입에 맞게 자동 설정됩니다(아래 GPU 타입 사양 참고).

3단계: 네트워크 & 애드온

CNI는 Cilium으로 고정입니다. eBPF 기반 네트워킹을 제공하며 Pod/Service CIDR과 Cluster Mesh ID가 자동으로 할당됩니다.

클러스터에 함께 설치할 애드온을 선택합니다.

애드온 설명
Velero 백업 백업/복원 기능. 활성화 시 예약 백업 크론 표현식 입력 가능
정책 엔진 (Kyverno) 보안 정책 엔진. Audit(감사만) 또는 Enforce(차단) 모드 선택
공유 스토리지 (CephFS RWX) 여러 파드가 동시에 읽고 쓸 수 있는 RWX 볼륨 드라이버 활성화
GPU Operator GPU 노드 풀이 있는 클러스터에 NVIDIA 드라이버 · 디바이스 플러그인 자동 설치
모니터링 스택 Prometheus Exporter, Metrics Server 등 메트릭 수집기 자동 배포

GPU 노드 풀이 있으면 GPU 분할 수(deviceSplitCount, 1~64) 를 지정해 하나의 물리 GPU를 여러 파드가 나눠 쓰도록 설정할 수 있습니다.

참고

GPU Operator와 모니터링 스택은 조건이 충족되면(각각 GPU 노드 풀 존재, 클러스터 생성 시) 자동으로 설치됩니다.

4단계: 리뷰 & 생성

입력한 내용을 요약해 보여줍니다. 확인 후 생성을 실행하면 프로비저닝이 시작됩니다.


GPU 풀 사양 선택

GPU 풀은 두 단계로 지정합니다. GPU 타입으로 노드에 붙일 물리 GPU를 고르고, 노드 사양으로 그 GPU를 감싸는 VM의 vCPU · 메모리를 고릅니다. 두 축은 독립적이므로 어떤 GPU에도 어떤 사양을 조합할 수 있습니다.

1단계 — GPU 타입

GPU 타입 VRAM 설명
L40S 48 GB NVIDIA L40S — 대형 추론/학습
RTX PRO 6000 96 GB NVIDIA RTX PRO 6000 Blackwell

GPU는 패스스루로 전달되므로 VRAM 전량을 게스트가 그대로 사용합니다. 선택 가능한 타입은 호스트 클러스터에 실제로 패스스루 등록된 장치만 노출됩니다. 사용할 GPU가 목록에 없으면 플랫폼 관리자에게 문의하세요.

2단계 — 노드 사양

사양 vCPU 메모리
Small 8 32 GiB
Medium (기본값) 16 64 GiB

주의

GPU 패스스루는 VM 메모리 전체를 호스트 물리 메모리에 고정(page pinning)합니다. 이 메모리는 GPU 호스트에 hugepages로 미리 예약되어 있어야 하며, 예약량보다 큰 사양을 선택하면 워커 VM이 생성되지 않고 대기 상태에 머뭅니다. 사용 가능한 사양은 플랫폼 관리자에게 확인하세요.

GPU는 노드당 1장이 할당됩니다.


생성 완료 확인

클러스터 생성은 다음 단계를 거칩니다:

상태 설명
requested 생성 요청이 접수됨
provisioning 컨트롤 플레인 및 노드 VM 프로비저닝 중
bootstrapping K8s 컴포넌트 초기화 및 애드온 설치 중
running 클러스터 준비 완료

진행 상황은 Operations 페이지에서 단계별로 확인할 수 있습니다.


관련 항목