문서 목차
클러스터 생성
QKS에서 클러스터를 생성하면 컨트롤 플레인과 워커 노드가 자동으로 프로비저닝됩니다. 일반적으로 3 10분 내에 사용 가능한 상태가 됩니다.
QUANTUM C&S
개요
QKS에서 클러스터를 생성하면 컨트롤 플레인과 워커 노드가 자동으로 프로비저닝됩니다. 일반적으로 3~10분 내에 사용 가능한 상태가 됩니다.
생성 절차
클러스터 목록에서 클러스터 생성 버튼을 클릭하면 4단계 마법사가 열립니다.
1단계: 기본 정보
| 항목 | 설명 | 규칙 |
|---|---|---|
| 클러스터 이름 | 클러스터 식별자 | 2~56자. 영문 소문자 · 숫자 · 하이픈만 사용하며, 첫 글자와 마지막 글자는 영문 소문자 또는 숫자여야 합니다. |
| 표시 이름 | 콘솔에 표시되는 이름 | 자유 입력 |
| Kubernetes 버전 | 사용할 K8s 버전 | v1.33.10 / v1.34.6 / v1.35.3 / v1.36.1 중 선택 |
참고
이름은 입력하는 즉시 중복 여부와 형식이 검사됩니다. 최대 56자인 이유는 클러스터마다
tenant-<이름>네임스페이스가 만들어지고, 네임스페이스 이름이 63자로 제한되기 때문입니다.
2단계: 노드 설정
노드 풀 단위로 워커 노드의 사양과 개수를 지정합니다. 노드 풀은 여러 개 추가할 수 있습니다.
| 항목 | 설명 |
|---|---|
| 노드 풀 이름 | 영문 소문자 · 숫자 · 하이픈. 기본값은 default-pool |
| 노드 타입 | 아래 프리셋 중 선택 (직접 입력이 아닌 카드 선택) |
| 노드 수 | 워커 노드의 수 (1~10) — 생성 시 한도. 생성 후에는 노드 풀 스케일로 최대 100까지 늘릴 수 있습니다. |
| 노드당 디스크 | 루트 디스크 크기 (10~500 GB, 기본 100 GB / GPU 노드 풀 기본 200 GB) |
CPU 노드 타입
| 타입 | vCPU | 메모리 |
|---|---|---|
Small |
2 | 4 GiB |
Medium (기본) |
4 | 8 GiB |
Large |
8 | 16 GiB |
XLarge |
16 | 32 GiB |
GPU 노드 풀로 만들려면 GPU 타입을 선택합니다. GPU 타입을 고르면 vCPU와 메모리가 타입에 맞게 자동 설정됩니다(아래 GPU 타입 사양 참고).
3단계: 네트워크 & 애드온
CNI는 Cilium으로 고정입니다. eBPF 기반 네트워킹을 제공하며 Pod/Service CIDR과 Cluster Mesh ID가 자동으로 할당됩니다.
클러스터에 함께 설치할 애드온을 선택합니다.
| 애드온 | 설명 |
|---|---|
| Velero 백업 | 백업/복원 기능. 활성화 시 예약 백업 크론 표현식 입력 가능 |
| 정책 엔진 (Kyverno) | 보안 정책 엔진. Audit(감사만) 또는 Enforce(차단) 모드 선택 |
| 공유 스토리지 (CephFS RWX) | 여러 파드가 동시에 읽고 쓸 수 있는 RWX 볼륨 드라이버 활성화 |
| GPU Operator | GPU 노드 풀이 있는 클러스터에 NVIDIA 드라이버 · 디바이스 플러그인 자동 설치 |
| 모니터링 스택 | Prometheus Exporter, Metrics Server 등 메트릭 수집기 자동 배포 |
GPU 노드 풀이 있으면 GPU 분할 수(deviceSplitCount, 1~64) 를 지정해 하나의 물리 GPU를 여러 파드가 나눠 쓰도록 설정할 수 있습니다.
참고
GPU Operator와 모니터링 스택은 조건이 충족되면(각각 GPU 노드 풀 존재, 클러스터 생성 시) 자동으로 설치됩니다.
4단계: 리뷰 & 생성
입력한 내용을 요약해 보여줍니다. 확인 후 생성을 실행하면 프로비저닝이 시작됩니다.
GPU 풀 사양 선택
GPU 풀은 두 단계로 지정합니다. GPU 타입으로 노드에 붙일 물리 GPU를 고르고, 노드 사양으로 그 GPU를 감싸는 VM의 vCPU · 메모리를 고릅니다. 두 축은 독립적이므로 어떤 GPU에도 어떤 사양을 조합할 수 있습니다.
1단계 — GPU 타입
| GPU 타입 | VRAM | 설명 |
|---|---|---|
L40S |
48 GB | NVIDIA L40S — 대형 추론/학습 |
RTX PRO 6000 |
96 GB | NVIDIA RTX PRO 6000 Blackwell |
GPU는 패스스루로 전달되므로 VRAM 전량을 게스트가 그대로 사용합니다. 선택 가능한 타입은 호스트 클러스터에 실제로 패스스루 등록된 장치만 노출됩니다. 사용할 GPU가 목록에 없으면 플랫폼 관리자에게 문의하세요.
2단계 — 노드 사양
| 사양 | vCPU | 메모리 |
|---|---|---|
Small |
8 | 32 GiB |
Medium (기본값) |
16 | 64 GiB |
주의
GPU 패스스루는 VM 메모리 전체를 호스트 물리 메모리에 고정(page pinning)합니다. 이 메모리는 GPU 호스트에 hugepages로 미리 예약되어 있어야 하며, 예약량보다 큰 사양을 선택하면 워커 VM이 생성되지 않고 대기 상태에 머뭅니다. 사용 가능한 사양은 플랫폼 관리자에게 확인하세요.
GPU는 노드당 1장이 할당됩니다.
생성 완료 확인
클러스터 생성은 다음 단계를 거칩니다:
| 상태 | 설명 |
|---|---|
requested |
생성 요청이 접수됨 |
provisioning |
컨트롤 플레인 및 노드 VM 프로비저닝 중 |
bootstrapping |
K8s 컴포넌트 초기화 및 애드온 설치 중 |
running |
클러스터 준비 완료 |
진행 상황은 Operations 페이지에서 단계별로 확인할 수 있습니다.