GPU SERVER

NVIDIA GPU, 빌려 쓰거나 직접 지으세요.

필요한 만큼 시간 단위로 쓰는 GPU Cloud, 그리고 전용 클러스터를 설계·구축·운영하는 Cluster Build. B300·B200·GB300·H200 SXM 기반으로 두 가지 방식을 모두 제공합니다.

두 가지 방식으로 GPU를 제공합니다.

지금 당장 GPU가 필요하면 GPU Cloud에서 시간 단위로 빌려 쓰세요. 전용 인프라나 특정 토폴로지, 데이터 소재지 요건이 있으면 Cluster Build로 직접 지어 드립니다. 두 방식 모두 같은 GPU 라인업을 씁니다.

GPU CLOUD

빌려 쓰기

포털에서 GPU를 골라 생성하면 바로 쓸 수 있습니다. 온디맨드는 시간 단위 과금, 몇 주 이상이면 예약 인스턴스로 단가를 낮춥니다.

B300 $7.38/hr 부터
약정 없이 시작
PFS 스토리지 GiB당 $0.20/월
CLUSTER BUILD

직접 짓기

GPU 선정, 패브릭 설계, 전력·냉각, 설치, 운영까지 한 팀이 맡아 전용 클러스터를 구축합니다.

고객 전용 클러스터
인터커넥트 토폴로지 설계
당사 또는 고객 사이트 배치
GPU LINE-UP

Blackwell과 Hopper, 필요한 세대를 고르세요.

BLACKWELL

NVIDIA B300

288GB
VRAM

노드당 메모리가 가장 크고, 큰 모델을 적은 노드로 다룹니다.

BLACKWELL

NVIDIA B200

192GB
VRAM

Blackwell 세대의 기본 선택. 학습과 추론 양쪽에 씁니다.

BLACKWELL

NVIDIA GB300

288GB × N
VRAM

NVL 랙 단위로 제공되며 예약 계약으로만 배정됩니다.

HOPPER

NVIDIA H200 SXM

141GB
VRAM

공급이 안정적이고 단가가 낮아 추론에 유리합니다.

AROUND THE GPU

GPU만으로는 학습이 돌지 않습니다.

패브릭이 좁으면 GPU가 놀고, 스토리지가 느리면 체크포인트에서 막힙니다. 두 상품 모두 아래 요소를 함께 제공합니다.

인터커넥트
InfiniBand NDR / XDR

노드 간 통신은 InfiniBand로 처리합니다. 토폴로지는 규모와 통신 패턴에 따라 결정합니다.

스토리지
PFS 클러스터 스토리지 + Object Storage

체크포인트와 학습 데이터는 NVMe 기반 PFS에, 아카이브는 S3 호환 Object Storage에 둡니다.

네트워크
자체 백본

데이터 반입·반출은 PacketStream 백본과 ISP 직접 연결을 통해 처리합니다.

관측성
텔레메트리 연동

GPU·노드·패브릭 메트릭을 Prometheus, Grafana, Datadog 등 기존 스택으로 내보냅니다.

인계 방식
베어메탈 또는 Kubernetes

OS까지만 올려 인계하거나, Kubernetes와 스케줄러를 구성해 인계합니다.

주요 사용 사례

모델 학습

파운데이션 모델 사전학습
파인튜닝·정렬
멀티노드 분산 학습

추론 서비스

LLM 서빙
긴 컨텍스트 처리
배치 추론

데이터 처리

전처리·임베딩
벡터 인덱싱
RAG 파이프라인

규제 환경

데이터 소재지 요건
폐쇄망 구성
감사 로그

어느 쪽이 맞는지 모르겠다면

워크로드와 필요한 GPU 물량, 사용 기간을 알려주시면 어느 방식이 저렴한지 계산해 드립니다.