비용 가이드 · 6분 분량

# 월 단위 임대가 시간 단위 임대보다 유리해지는 지점.

시간당 과금은 오늘 끝나는 작업에 맞는 답입니다. 대부분이 예상하는 것보다 빨리 틀린 답이 됩니다 — 그리고 손익분기점은 의견이 아니라 계산입니다.

짧은 답

- **당사 월 가격:** NVIDIA H100 PCIe 카드 1장에 $1,469 — 나눠 보면 시간당 $2.01
- **손익분기점:** 시간당 $2.99 클라우드 대비 **492시간**을 넘으면 월 단위가 더 저렴 — 약 20일
- **진짜 질문:** “몇 시간을 계산할 것인가”가 아니라 “머신이 몇 시간 존재할 것인가”
- **시간 단위가 유리한 경우:** 오늘 끝나는 작업, 또는 진짜 버스트성이면서 축출을 감당할 수 있는 부하

## 손익분기점

NVIDIA H100 PCIe 카드 1장을 당사 월 가격 $1,469 기준으로 두고, 같은 카드를 시간 단위로 임대하는 3가지 방식과 비교합니다. 손익분기점은 시간당 과금이 한 달 가격만큼 쌓이는 지점입니다.

**월 단위가 시간당 과금보다 저렴해지는 시간**

| 시간 단위 옵션 | 시간당 | 한 달 전체 | Break-even | 24/7 가동 시 절감액 |
|---|---|---|---|---|
| 하이퍼스케일러, 온디맨드 약정 할인은 1년 기간과 계약서가 필요함 | $6.98 | $5,095730시간 | 211 h 9일 | $3,626 매월 |
| 전문 GPU 클라우드 초당 과금, 약정 없음 | $2.99 | $2,183730시간 | 492 h 21일 | $714 매월 |
| 마켓플레이스, 커뮤니티 등급 남의 머신, 중단 가능 | $1.89 | $1,380730시간 | 778 h 32일 | 시간 단위가 더 저렴 |
| 당사 월 단위 이용 기간 전용, 사용량 과금 없음, 축출 없음 | $2.01계산으로 도출한 값, 청구하지 않음 | $1,469 | — | — |

시간 단위 수치는 같은 카드의 공개 정가이며, August 2026 기준으로 조사한 값입니다. 당사는 시간 단위로 청구하지 않습니다. 당사 행의 시간당 수치는 월 가격을 730시간으로 나눈 값이고, 열을 비교할 수 있도록 표시한 것뿐입니다.

## 계산

3줄이고, 두 번째 줄에서 대부분의 추정이 틀어지기 때문에 적어 둘 만합니다.

손익분기점(시간)

```
break_even_hours = monthly_price / hourly_price

# For this card, against a $2.99/hour cloud:
$1,469 / $2.99 = 492 hours = 20.5 days

# The mistake: counting only the hours you compute.
# The meter runs while the machine exists, not while it works.
hours_billed = hours_the_instance_is_running   # not hours of useful work
```

한 달은 730시간입니다. 머신이 30일 중 약 20일 넘게 존재해야 한다면 월 단위가 더 저렴합니다 — 그 지점을 넘는 시간은 모두 순수한 절감입니다.

## 시간 단위 가격이 감추는 것

공개된 단가는 비교할 수 있는 부분입니다. 이 3가지는 비교할 수 없는 부분이고, 합쳐 놓으면 대개 단가 자체보다 더 중요합니다.

### 별도로 청구되는 스토리지

대부분의 시간 단위 플랫폼에서 디스크는 별도 청구 항목이고, 월 GB당 과금되며, 인스턴스를 중지한 동안에도 계속 과금됩니다. 사용량이 적은 달에는 2 TB 데이터셋이 GPU보다 조용히 더 비싸질 수 있습니다.

**여기서는:** 2 × 2 TB NVMe 디스크가 가격에 포함되어 있고, 사용량 기반 과금은 없습니다.

### 송신 트래픽

모델 가중치, 체크포인트, 생성된 출력물을 *밖으로* 빼내는 데는 거의 모든 곳에서 GB당 요금이 붙습니다. 작업이 성공한 뒤에야 나타나는 비용입니다.

**여기서는:** 1 Gbit/s 무제한 포트, 양방향, 어떤 용량에서도 초과 요금 없음.

### 콜드 스타트와 축출

140 GB 모델을 새 인스턴스로 내려받는 데 15분에서 40분이 걸리고, 그 시간은 요금을 내면서 아무것도 얻지 못하는 시간입니다. 중단 가능 등급에서는 실행 도중 축출될 때마다 이 비용을 다시 지불합니다.

**여기서는:** 이용 기간 동안 머신은 고객의 것입니다. 가중치는 그 디스크에 그대로 남아 있습니다.

## 유휴 시간의 함정

신중한 추정치를 3배 큰 청구서로 바꿔 놓는 것이 바로 이것입니다. 초당 과금은 인스턴스를 중지할 수 있으니 안전해 보입니다 — 그러나 거의 아무도 중지하지 않습니다. 중지하면 그 위에 있는 상태를 잃기 때문입니다.

**실제 사용률 수준별 월 비용, 시간 단위 대 월 단위**

| 머신 가동 | 시간 | 시간당 $2.99 | 당사 월 가격 | 더 저렴한 쪽 |
|---|---|---|---|---|
| 주 몇 시간 | 12 h | $36 | $1,469 | 시간 단위가 $1,433만큼 저렴 |
| 평일 근무 시간 | 176 h | $526 | $1,469 | 시간 단위가 $943만큼 저렴 |
| 매일 근무 시간 | 240 h | $718 | $1,469 | 시간 단위가 $751만큼 저렴 |
| Continuously | 730 h | $2,183 | $1,469 | 월 단위가 $714만큼 저렴 |

두 번째 행을 주의해서 보십시오. “평일 근무 시간”은 대수롭지 않아 보이지만 이미 선을 넘은 쪽입니다 — 게다가 매일 저녁 인스턴스를 꼬박꼬박 중지한다는 전제가 깔려 있고, 그러려면 아끼는 것이 그 위에 하나도 없어야 합니다.

**솔직한 질문을 던지십시오.** “GPU를 몇 시간 쓸 것인가”가 아니라 “이 머신이 몇 시간 존재해야 하는가”입니다. 요청에 응답하는 엔드포인트, 계속 다듬고 있는 모델, 다시 내려받고 싶지 않은 데이터셋 — 모두 사용률 그래프가 무엇을 말하든 머신이 계속 존재해야 하는 경우입니다.

## 더 긴 이용 기간

답이 “1년”이라면 월 가격이 가장 좋은 가격도 아닙니다. 같은 카드를 당사의 3가지 이용 기간으로 비교하면:

**이용 기간별 동일 구성**

| 기간 | 월 요금 | 선불 | 1년간 절감액 | 절충점 |
|---|---|---|---|---|
| 월 단위 월 단위 청구, 언제든지 해지 가능 | $1,469 | $1,469 | — | 없음. 갱신일 전에 해지하면 그대로 종료됩니다. |
| 3개월 3개월 이용 기간, 매월 5% 할인 | $1,396 | $4,188 | $876 | 선불이며 일할 계산으로 환불되지 않습니다. 그것이 할인의 대가입니다. |
| 12개월 12개월 이용 기간, 매월 12% 할인 | $1,293 | $15,516 | $2,112 | 선불이며 일할 계산으로 환불되지 않습니다. 그것이 할인의 대가입니다. |

## 시간 단위가 정말 맞는 경우

당사는 시간 단위로 판매하지 않습니다. 그러니 이 절은 있는 그대로 읽으십시오: 다른 곳을 이용해야 하는 경우입니다.

**오늘 끝나는 작업.** 파인튜닝 1회, 벤치마크 1회, 렌더링 1회. 시간 단위로 임대해 4시간 요금을 결제하고 끝내십시오.

**축출을 감당할 수 있는 진짜 버스트성 부하.** 작업이 체크포인트를 깔끔하게 남기고 실행 도중에 종료되어도 괜찮다면, 중단 가능 용량이 어떤 전용 자원보다도 훨씬 저렴합니다.

**카드 8장을 6시간, 한 번만 필요한 경우.** 실험 1개를 돌리려고 GPU 8장 노드를 월 단위로 임대하는 것은 잘못된 형태의 구매입니다.

**아직 모르는 경우.** 사용률 그래프가 실제로 필요한 것을 알려 줄 때까지 시간 단위로 임대하고, 그런 다음 숫자를 들고 다시 오십시오.

그 밖의 모든 경우 — 응답해야 하는 엔드포인트, 한 분기 동안 함께 지낼 모델, 모델을 올려 둔 채 두고 싶은 카드 — 한 달 비용이 사용량 과금보다 저렴하고 동작도 더 낫습니다. 그리고 약정 할인과 달리 여기서의 월 단위 이용 기간에는 계약서도, 법인도, 신원 확인도 필요 없습니다: [결제 한 번](https://gpuserver.io/ko/guides/pay-in-crypto)이면 머신은 고객의 것입니다.

## 카탈로그의 모든 가격은 월 단위 가격입니다.

사용량 과금 없음, 송신 트래픽 요금 없음, 스토리지 별도 청구 항목 없음, 여기에 더할 설치비도 없음.

[카탈로그 둘러보기](https://gpuserver.io/ko/#catalog) [가이드 둘러보기](https://gpuserver.io/ko/guides)

## 다른 가이드

- [비용 · 9분 자체 호스팅 대 토큰당 과금 API 토큰당 과금 API와 GPU 임대 사이의 손익분기점을 당사의 실제 가격과 처리량으로 계산했습니다 — 그리고 그 계산이 빠뜨리는 4가지. 가이드 읽기](https://gpuserver.io/ko/guides/api-vs-self-hosting)
- [실전 · 11분 노드 1개로 Llama 3.3 70B 서빙 제공받은 머신에서 OpenAI 호환 엔드포인트까지, 중요한 플래그와 처리량을 조용히 절반으로 떨어뜨리는 두 가지 플래그. 가이드 읽기](https://gpuserver.io/ko/guides/serve-llama-70b)
- [실전 · 10분 카드 1장에서 70B 모델 파인튜닝 48 GB GPU 1장으로 QLoRA를 돌릴 때 무엇이 들어가고, 한 달 비용이 얼마이며, 전체 파인튜닝이 왜 완전히 다른 급의 머신을 요구하는지 설명합니다. 가이드 읽기](https://gpuserver.io/ko/guides/lora-finetune)

---

출처: https://gpuserver.io/ko/guides/monthly-vs-hourly/. 이 파일은 웹사이트와 동일한 데이터에서 생성됩니다. 여기의 수치가 페이지와 다르다면 페이지가 정본이고 이 파일이 오래된 것입니다 — 정식 출처는 https://gpuserver.io/입니다.
