월 단위 임대가 시간 단위 임대보다 유리해지는 지점.
시간당 과금은 오늘 끝나는 작업에 맞는 답입니다. 대부분이 예상하는 것보다 빨리 틀린 답이 됩니다 — 그리고 손익분기점은 의견이 아니라 계산입니다.
짧은 답
- 당사 월 가격
- NVIDIA H100 PCIe 카드 1장에 $1,469 — 나눠 보면 시간당 $2.01
- 손익분기점
- 시간당 $2.99 클라우드 대비 492시간을 넘으면 월 단위가 더 저렴 — 약 20일
- 진짜 질문
- “몇 시간을 계산할 것인가”가 아니라 “머신이 몇 시간 존재할 것인가”
- 시간 단위가 유리한 경우
- 오늘 끝나는 작업, 또는 진짜 버스트성이면서 축출을 감당할 수 있는 부하
손익분기점
NVIDIA H100 PCIe 카드 1장을 당사 월 가격 $1,469 기준으로 두고, 같은 카드를 시간 단위로 임대하는 3가지 방식과 비교합니다. 손익분기점은 시간당 과금이 한 달 가격만큼 쌓이는 지점입니다.
| 시간 단위 옵션 | 시간당 | 한 달 전체 | Break-even | 24/7 가동 시 절감액 |
|---|---|---|---|---|
| 하이퍼스케일러, 온디맨드 | $6.98 | $5,095 | 211 h | $3,626 |
| 전문 GPU 클라우드 | $2.99 | $2,183 | 492 h | $714 |
| 마켓플레이스, 커뮤니티 등급 | $1.89 | $1,380 | 778 h | 시간 단위가 더 저렴 |
| 당사 월 단위 이용 기간 | $2.01 | $1,469 | — | — |
시간 단위 수치는 같은 카드의 공개 정가이며, August 2026 기준으로 조사한 값입니다. 당사는 시간 단위로 청구하지 않습니다. 당사 행의 시간당 수치는 월 가격을 730시간으로 나눈 값이고, 열을 비교할 수 있도록 표시한 것뿐입니다.
계산
3줄이고, 두 번째 줄에서 대부분의 추정이 틀어지기 때문에 적어 둘 만합니다.
break_even_hours = monthly_price / hourly_price
# For this card, against a $2.99/hour cloud:
$1,469 / $2.99 = 492 hours = 20.5 days
# The mistake: counting only the hours you compute.
# The meter runs while the machine exists, not while it works.
hours_billed = hours_the_instance_is_running # not hours of useful work
한 달은 730시간입니다. 머신이 30일 중 약 20일 넘게 존재해야 한다면 월 단위가 더 저렴합니다 — 그 지점을 넘는 시간은 모두 순수한 절감입니다.
시간 단위 가격이 감추는 것
공개된 단가는 비교할 수 있는 부분입니다. 이 3가지는 비교할 수 없는 부분이고, 합쳐 놓으면 대개 단가 자체보다 더 중요합니다.
별도로 청구되는 스토리지
대부분의 시간 단위 플랫폼에서 디스크는 별도 청구 항목이고, 월 GB당 과금되며, 인스턴스를 중지한 동안에도 계속 과금됩니다. 사용량이 적은 달에는 2 TB 데이터셋이 GPU보다 조용히 더 비싸질 수 있습니다.
여기서는: 2 × 2 TB NVMe 디스크가 가격에 포함되어 있고, 사용량 기반 과금은 없습니다.
송신 트래픽
모델 가중치, 체크포인트, 생성된 출력물을 밖으로 빼내는 데는 거의 모든 곳에서 GB당 요금이 붙습니다. 작업이 성공한 뒤에야 나타나는 비용입니다.
여기서는: 1 Gbit/s 무제한 포트, 양방향, 어떤 용량에서도 초과 요금 없음.
콜드 스타트와 축출
140 GB 모델을 새 인스턴스로 내려받는 데 15분에서 40분이 걸리고, 그 시간은 요금을 내면서 아무것도 얻지 못하는 시간입니다. 중단 가능 등급에서는 실행 도중 축출될 때마다 이 비용을 다시 지불합니다.
여기서는: 이용 기간 동안 머신은 고객의 것입니다. 가중치는 그 디스크에 그대로 남아 있습니다.
유휴 시간의 함정
신중한 추정치를 3배 큰 청구서로 바꿔 놓는 것이 바로 이것입니다. 초당 과금은 인스턴스를 중지할 수 있으니 안전해 보입니다 — 그러나 거의 아무도 중지하지 않습니다. 중지하면 그 위에 있는 상태를 잃기 때문입니다.
| 머신 가동 | 시간 | 시간당 $2.99 | 당사 월 가격 | 더 저렴한 쪽 |
|---|---|---|---|---|
| 주 몇 시간 | 12 h | $36 | $1,469 | 시간 단위가 $1,433만큼 저렴 |
| 평일 근무 시간 | 176 h | $526 | $1,469 | 시간 단위가 $943만큼 저렴 |
| 매일 근무 시간 | 240 h | $718 | $1,469 | 시간 단위가 $751만큼 저렴 |
| Continuously | 730 h | $2,183 | $1,469 | 월 단위가 $714만큼 저렴 |
두 번째 행을 주의해서 보십시오. “평일 근무 시간”은 대수롭지 않아 보이지만 이미 선을 넘은 쪽입니다 — 게다가 매일 저녁 인스턴스를 꼬박꼬박 중지한다는 전제가 깔려 있고, 그러려면 아끼는 것이 그 위에 하나도 없어야 합니다.
더 긴 이용 기간
답이 “1년”이라면 월 가격이 가장 좋은 가격도 아닙니다. 같은 카드를 당사의 3가지 이용 기간으로 비교하면:
| 기간 | 월 요금 | 선불 | 1년간 절감액 | 절충점 |
|---|---|---|---|---|
| 월 단위 | $1,469 | $1,469 | — | 없음. 갱신일 전에 해지하면 그대로 종료됩니다. |
| 3개월 | $1,396 | $4,188 | $876 | 선불이며 일할 계산으로 환불되지 않습니다. 그것이 할인의 대가입니다. |
| 12개월 | $1,293 | $15,516 | $2,112 | 선불이며 일할 계산으로 환불되지 않습니다. 그것이 할인의 대가입니다. |
시간 단위가 정말 맞는 경우
당사는 시간 단위로 판매하지 않습니다. 그러니 이 절은 있는 그대로 읽으십시오: 다른 곳을 이용해야 하는 경우입니다.
오늘 끝나는 작업. 파인튜닝 1회, 벤치마크 1회, 렌더링 1회. 시간 단위로 임대해 4시간 요금을 결제하고 끝내십시오.
축출을 감당할 수 있는 진짜 버스트성 부하. 작업이 체크포인트를 깔끔하게 남기고 실행 도중에 종료되어도 괜찮다면, 중단 가능 용량이 어떤 전용 자원보다도 훨씬 저렴합니다.
카드 8장을 6시간, 한 번만 필요한 경우. 실험 1개를 돌리려고 GPU 8장 노드를 월 단위로 임대하는 것은 잘못된 형태의 구매입니다.
아직 모르는 경우. 사용률 그래프가 실제로 필요한 것을 알려 줄 때까지 시간 단위로 임대하고, 그런 다음 숫자를 들고 다시 오십시오.
그 밖의 모든 경우 — 응답해야 하는 엔드포인트, 한 분기 동안 함께 지낼 모델, 모델을 올려 둔 채 두고 싶은 카드 — 한 달 비용이 사용량 과금보다 저렴하고 동작도 더 낫습니다. 그리고 약정 할인과 달리 여기서의 월 단위 이용 기간에는 계약서도, 법인도, 신원 확인도 필요 없습니다: 결제 한 번이면 머신은 고객의 것입니다.
다른 가이드
- 비용 · 9분
자체 호스팅 대 토큰당 과금 API
토큰당 과금 API와 GPU 임대 사이의 손익분기점을 당사의 실제 가격과 처리량으로 계산했습니다 — 그리고 그 계산이 빠뜨리는 4가지.
가이드 읽기 - 실전 · 11분
노드 1개로 Llama 3.3 70B 서빙
제공받은 머신에서 OpenAI 호환 엔드포인트까지, 중요한 플래그와 처리량을 조용히 절반으로 떨어뜨리는 두 가지 플래그.
가이드 읽기 - 실전 · 10분
카드 1장에서 70B 모델 파인튜닝
48 GB GPU 1장으로 QLoRA를 돌릴 때 무엇이 들어가고, 한 달 비용이 얼마이며, 전체 파인튜닝이 왜 완전히 다른 급의 머신을 요구하는지 설명합니다.
가이드 읽기