Quando o aluguel mensal vence o por hora.
O preço por hora é a resposta certa para um job que termina hoje. Ele vira a resposta errada mais cedo do que a maioria imagina — e o ponto de equilíbrio é aritmética, não opinião.
A resposta curta
- Nosso preço mensal
- $1,469 por NVIDIA H100 PCIe — $2.01 por hora, se dividido
- O ponto de equilíbrio
- Contra uma nuvem a $2.99/hora, o mensal vence a partir de 492 horas — cerca de 20 dias
- A pergunta real
- Não "quantas horas vou computar", mas "quantas horas a máquina vai existir"
- Onde por hora vence
- Um job que termina hoje, ou uma carga genuinamente em rajadas que tolera evicção
O ponto de equilíbrio
Uma NVIDIA H100 PCIe, ao nosso preço mensal de $1,469, contra três formas de alugar a mesma placa por hora. O ponto de equilíbrio é onde o contador já custou a você o que um mês inteiro nos custa.
| Opção por hora | Por hora | Um mês inteiro | Break-even | Você economiza em 24/7 |
|---|---|---|---|---|
| Hyperscaler, sob demanda | $6.98 | $5,095 | 211 h | $3,626 |
| Nuvem GPU especializada | $2.99 | $2,183 | 492 h | $714 |
| Marketplace, nível comunitário | $1.89 | $1,380 | 778 h | Por hora é mais barato |
| Nosso prazo mensal | $2.01 | $1,469 | — | — |
Os valores por hora são preços públicos de tabela para a mesma placa, observados em August 2026. Não cobramos por hora; o valor por hora na nossa própria linha é o preço mensal dividido por 730, mostrado apenas para que as colunas possam ser comparadas.
A aritmética
Três linhas, que vale a pena detalhar porque é na segunda que a maioria das estimativas erra.
break_even_hours = monthly_price / hourly_price
# For this card, against a $2.99/hour cloud:
$1,469 / $2.99 = 492 hours = 20.5 days
# The mistake: counting only the hours you compute.
# The meter runs while the machine exists, not while it works.
hours_billed = hours_the_instance_is_running # not hours of useful work
Um mês tem 730 horas. Se sua máquina precisa existir por mais de cerca de 20 dias em trinta, um prazo mensal sai mais barato — e cada hora além desse ponto é economia pura.
O que um preço por hora esconde
A tarifa publicada é a parte que dá para comparar. Estas três são a parte que não dá, e juntas costumam pesar mais do que a própria tarifa.
Armazenamento cobrado separadamente
Na maioria das plataformas por hora, o disco é um item separado na fatura, cobrado por GB por mês, e continua sendo cobrado mesmo com a instância parada. Um dataset de 2 TB pode, silenciosamente, custar mais do que a GPU em um mês de pouco uso.
Aqui: 2 × 2 TB NVMe está incluído no preço, e nada é medido por contador.
Tráfego de saída
Tirar os pesos do seu modelo, os checkpoints ou a saída gerada para fora é cobrado por gigabyte em quase todo lugar. É o custo que só aparece depois que o trabalho dá certo.
Aqui: 1 Gbit/s, sem contador, nas duas direções, sem excedente em nenhum volume.
Cold start e evicção
Baixar um modelo de 140 GB em uma instância nova consome de quinze a quarenta minutos que você paga e dos quais não tira nada. Em níveis interruptíveis, você paga isso de novo toda vez que é evictado no meio da execução.
Aqui: a máquina é sua durante o prazo. Os pesos ficam nos discos dela e permanecem lá.
A armadilha do tempo ocioso
Este é o fator que transforma uma estimativa cuidadosa em uma fatura três vezes maior. A cobrança por segundo parece segura porque você pode parar a instância — e quase ninguém para, porque parar significa perder o estado que está nela.
| A máquina roda | Horas | A $2.99/h | Nosso mensal | Mais barato |
|---|---|---|---|---|
| Algumas horas por semana | 12 h | $36 | $1,469 | Por hora, por $1,433 |
| Horário comercial, dias úteis | 176 h | $526 | $1,469 | Por hora, por $943 |
| Todos os dias, horário comercial | 240 h | $718 | $1,469 | Por hora, por $751 |
| Continuously | 730 h | $2,183 | $1,469 | Mensal, por $714 |
Leia a segunda linha com atenção. "Horário comercial, dias úteis" parece modesto, mas já está do lado errado da linha — e isso pressupõe que você para a instância todo dia à noite, disciplinadamente, o que exige que nada importante esteja rodando nela.
Prazos mais longos
Se a resposta for "por um ano", o preço mensal também não é o melhor disponível. A mesma placa em nossos três prazos:
| Prazo | Por mês | Pago antecipadamente | Economizado em um ano | Compensação |
|---|---|---|---|---|
| Mensal | $1,469 | $1,469 | — | Nenhuma. Cancele antes da data de renovação e simplesmente para. |
| 3 meses | $1,396 | $4,188 | $876 | Pago antecipadamente, sem reembolso proporcional. É isso que o desconto compra. |
| 12 meses | $1,293 | $15,516 | $2,112 | Pago antecipadamente, sem reembolso proporcional. É isso que o desconto compra. |
Quando por hora realmente é a escolha certa
Não vendemos por hora, então entenda isto pelo que é: os casos em que você deveria procurar outro lugar.
Um job que termina hoje. Um fine-tune, um benchmark, uma renderização. Alugue por hora, pague quatro horas e pronto.
Carga genuinamente em rajadas, que tolera evicção. Se o seu trabalho salva checkpoints de forma limpa e pode ser interrompido no meio da execução, a capacidade interruptível é drasticamente mais barata do que qualquer coisa dedicada.
Você precisa de oito placas por seis horas, uma única vez. Um prazo mensal em um nó de 8 GPUs para rodar um único experimento é o formato errado de compra.
Você ainda não sabe. Alugue por hora até o gráfico de utilização mostrar o que você realmente precisa e depois volte com um número.
Em todos os outros casos — um endpoint que precisa responder, um modelo com o qual você vai conviver por um trimestre, uma placa que você quer manter carregada — um mês custa menos que o contador e se comporta melhor. E, diferente de um desconto por uso comprometido, um prazo mensal aqui não precisa de contrato, de empresa nem de verificação de identidade: é um único pagamento e a máquina é sua.
Todos os preços do catálogo são preços mensais.
Sem contador, sem cobrança de tráfego de saída, sem item de armazenamento separado, e sem taxa de instalação para somar a tudo isso.
Outros guias
- Custo · 9 min
Hospedagem própria contra uma API por token
O ponto de equilíbrio entre pagar uma API por token e alugar uma GPU, calculado com nossos preços e throughput — e as quatro coisas que a aritmética deixa de fora.
Ler o guia - Prática · 11 min
Servindo o Llama 3.3 70B em um nó
De uma máquina entregue a um endpoint compatível com OpenAI, com as flags que importam e as duas que reduzem seu throughput pela metade, silenciosamente.
Ler o guia - Prática · 10 min
Fine-tuning de um modelo de 70B em uma placa
QLoRA em uma única GPU de 48 GB: o que cabe, quanto custa por mês, e por que o fine-tuning completo exige outra categoria de máquina.
Ler o guia