Custo guia · 6 min de leitura

# Quando o aluguel mensal vence o por hora.

O preço por hora é a resposta certa para um job que termina hoje. Ele vira a resposta errada mais cedo do que a maioria imagina — e o ponto de equilíbrio é aritmética, não opinião.

A resposta curta

- **Nosso preço mensal:** $1,469 por NVIDIA H100 PCIe — $2.01 por hora, se dividido
- **O ponto de equilíbrio:** Contra uma nuvem a $2.99/hora, o mensal vence a partir de **492 horas** — cerca de 20 dias
- **A pergunta real:** Não "quantas horas vou computar", mas "quantas horas a máquina vai existir"
- **Onde por hora vence:** Um job que termina hoje, ou uma carga genuinamente em rajadas que tolera evicção

## O ponto de equilíbrio

Uma NVIDIA H100 PCIe, ao nosso preço mensal de $1,469, contra três formas de alugar a mesma placa por hora. O ponto de equilíbrio é onde o contador já custou a você o que um mês inteiro nos custa.

**Horas até um prazo mensal ficar mais barato que a cobrança por hora**

| Opção por hora | Por hora | Um mês inteiro | Break-even | Você economiza em 24/7 |
|---|---|---|---|---|
| Hyperscaler, sob demanda Descontos por uso comprometido exigem um ano e um contrato | $6.98 | $5,095730 horas | 211 h 9 dias | $3,626 todo mês |
| Nuvem GPU especializada Cobrança por segundo, sem compromisso | $2.99 | $2,183730 horas | 492 h 21 dias | $714 todo mês |
| Marketplace, nível comunitário A máquina de outra pessoa, interruptível | $1.89 | $1,380730 horas | 778 h 32 dias | Por hora é mais barato |
| Nosso prazo mensal Dedicado, sem contador, sem evicção | $2.01derivado, não cobrado | $1,469 | — | — |

Os valores por hora são preços públicos de tabela para a mesma placa, observados em August 2026. Não cobramos por hora; o valor por hora na nossa própria linha é o preço mensal dividido por 730, mostrado apenas para que as colunas possam ser comparadas.

## A aritmética

Três linhas, que vale a pena detalhar porque é na segunda que a maioria das estimativas erra.

Ponto de equilíbrio, em horas

```
break_even_hours = monthly_price / hourly_price

# For this card, against a $2.99/hour cloud:
$1,469 / $2.99 = 492 hours = 20.5 days

# The mistake: counting only the hours you compute.
# The meter runs while the machine exists, not while it works.
hours_billed = hours_the_instance_is_running   # not hours of useful work
```

Um mês tem 730 horas. Se sua máquina precisa existir por mais de cerca de 20 dias em trinta, um prazo mensal sai mais barato — e cada hora além desse ponto é economia pura.

## O que um preço por hora esconde

A tarifa publicada é a parte que dá para comparar. Estas três são a parte que não dá, e juntas costumam pesar mais do que a própria tarifa.

### Armazenamento cobrado separadamente

Na maioria das plataformas por hora, o disco é um item separado na fatura, cobrado por GB por mês, e continua sendo cobrado mesmo com a instância parada. Um dataset de 2 TB pode, silenciosamente, custar mais do que a GPU em um mês de pouco uso.

**Aqui:** 2 × 2 TB NVMe está incluído no preço, e nada é medido por contador.

### Tráfego de saída

Tirar os pesos do seu modelo, os checkpoints ou a saída gerada para *fora* é cobrado por gigabyte em quase todo lugar. É o custo que só aparece depois que o trabalho dá certo.

**Aqui:** 1 Gbit/s, sem contador, nas duas direções, sem excedente em nenhum volume.

### Cold start e evicção

Baixar um modelo de 140 GB em uma instância nova consome de quinze a quarenta minutos que você paga e dos quais não tira nada. Em níveis interruptíveis, você paga isso de novo toda vez que é evictado no meio da execução.

**Aqui:** a máquina é sua durante o prazo. Os pesos ficam nos discos dela e permanecem lá.

## A armadilha do tempo ocioso

Este é o fator que transforma uma estimativa cuidadosa em uma fatura três vezes maior. A cobrança por segundo parece segura porque você pode parar a instância — e quase ninguém para, porque parar significa perder o estado que está nela.

**Custo mensal em diferentes níveis de utilização real, por hora versus mensal**

| A máquina roda | Horas | A $2.99/h | Nosso mensal | Mais barato |
|---|---|---|---|---|
| Algumas horas por semana | 12 h | $36 | $1,469 | Por hora, por $1,433 |
| Horário comercial, dias úteis | 176 h | $526 | $1,469 | Por hora, por $943 |
| Todos os dias, horário comercial | 240 h | $718 | $1,469 | Por hora, por $751 |
| Continuously | 730 h | $2,183 | $1,469 | Mensal, por $714 |

Leia a segunda linha com atenção. "Horário comercial, dias úteis" parece modesto, mas já está do lado errado da linha — e isso pressupõe que você para a instância todo dia à noite, disciplinadamente, o que exige que nada importante esteja rodando nela.

**Faça a pergunta honesta.** Não "quantas horas vou usar a GPU", mas "quantas horas essa máquina vai precisar existir". Um endpoint que responde requisições, um modelo com o qual você está iterando, um dataset que você não quer baixar de novo — tudo isso exige que a máquina exista continuamente, não importa o que o gráfico de utilização diga.

## Prazos mais longos

Se a resposta for "por um ano", o preço mensal também não é o melhor disponível. A mesma placa em nossos três prazos:

**A mesma configuração em cada prazo**

| Prazo | Por mês | Pago antecipadamente | Economizado em um ano | Compensação |
|---|---|---|---|---|
| Mensal cobrança mensal, cancelar a qualquer momento | $1,469 | $1,469 | — | Nenhuma. Cancele antes da data de renovação e simplesmente para. |
| 3 meses prazo de 3 meses, 5% de desconto por mês | $1,396 | $4,188 | $876 | Pago antecipadamente, sem reembolso proporcional. É isso que o desconto compra. |
| 12 meses prazo de 12 meses, 12% de desconto por mês | $1,293 | $15,516 | $2,112 | Pago antecipadamente, sem reembolso proporcional. É isso que o desconto compra. |

## Quando por hora realmente é a escolha certa

Não vendemos por hora, então entenda isto pelo que é: os casos em que você deveria procurar outro lugar.

**Um job que termina hoje.** Um fine-tune, um benchmark, uma renderização. Alugue por hora, pague quatro horas e pronto.

**Carga genuinamente em rajadas, que tolera evicção.** Se o seu trabalho salva checkpoints de forma limpa e pode ser interrompido no meio da execução, a capacidade interruptível é drasticamente mais barata do que qualquer coisa dedicada.

**Você precisa de oito placas por seis horas, uma única vez.** Um prazo mensal em um nó de 8 GPUs para rodar um único experimento é o formato errado de compra.

**Você ainda não sabe.** Alugue por hora até o gráfico de utilização mostrar o que você realmente precisa e depois volte com um número.

Em todos os outros casos — um endpoint que precisa responder, um modelo com o qual você vai conviver por um trimestre, uma placa que você quer manter carregada — um mês custa menos que o contador e se comporta melhor. E, diferente de um desconto por uso comprometido, um prazo mensal aqui não precisa de contrato, de empresa nem de verificação de identidade: é [um único pagamento](https://gpuserver.io/pt/guides/pay-in-crypto) e a máquina é sua.

## Todos os preços do catálogo são preços mensais.

Sem contador, sem cobrança de tráfego de saída, sem item de armazenamento separado, e sem taxa de instalação para somar a tudo isso.

[Explorar o catálogo](https://gpuserver.io/pt/#catalog) [Ler os guias](https://gpuserver.io/pt/guides)

## Outros guias

- [Custo · 9 min Hospedagem própria contra uma API por token O ponto de equilíbrio entre pagar uma API por token e alugar uma GPU, calculado com nossos preços e throughput — e as quatro coisas que a aritmética deixa de fora. Ler o guia](https://gpuserver.io/pt/guides/api-vs-self-hosting)
- [Prática · 11 min Servindo o Llama 3.3 70B em um nó De uma máquina entregue a um endpoint compatível com OpenAI, com as flags que importam e as duas que reduzem seu throughput pela metade, silenciosamente. Ler o guia](https://gpuserver.io/pt/guides/serve-llama-70b)
- [Prática · 10 min Fine-tuning de um modelo de 70B em uma placa QLoRA em uma única GPU de 48 GB: o que cabe, quanto custa por mês, e por que o fine-tuning completo exige outra categoria de máquina. Ler o guia](https://gpuserver.io/pt/guides/lora-finetune)

---

Fonte: https://gpuserver.io/pt/guides/monthly-vs-hourly/. Este arquivo é gerado a partir dos mesmos dados que o site; se um número aqui divergir de uma página, a página prevalece e este arquivo está desatualizado — a fonte canônica é https://gpuserver.io/.
