Quando il noleggio mensile batte quello orario.
Il prezzo orario è la risposta giusta per un lavoro che finisce oggi. Diventa la risposta sbagliata prima di quanto la maggior parte delle persone si aspetti — e il punto di pareggio è aritmetica, non opinione.
La risposta breve
- Il nostro prezzo mensile
- $1,469 per un NVIDIA H100 PCIe — $2.01 all’ora se lo si divide
- Il punto di pareggio
- Contro un cloud a $2.99/ora, il mensile conviene oltre le 492 ore — circa 20 giorni
- La vera domanda
- Non «quante ore calcolerò» ma «quante ore esisterà la macchina»
- Dove l’orario vince
- Un lavoro che finisce oggi, o un carico realmente discontinuo che può tollerare l’espulsione
Il punto di pareggio
Una NVIDIA H100 PCIe, al nostro prezzo mensile di $1,469, contro tre modi di noleggiare la stessa scheda a ore. Il punto di pareggio è il momento in cui il contatore le è costato quanto le costa un mese intero da noi.
| Opzione oraria | All’ora | Un mese intero | Break-even | Risparmia con il 24/7 |
|---|---|---|---|---|
| Hyperscaler, on demand | $6.98 | $5,095 | 211 h | $3,626 |
| Cloud GPU specializzato | $2.99 | $2,183 | 492 h | $714 |
| Marketplace, livello community | $1.89 | $1,380 | 778 h | L’orario è più economico |
| La nostra durata mensile | $2.01 | $1,469 | — | — |
Le cifre orarie sono i prezzi di listino pubblici per la stessa scheda, osservati in August 2026. Non fatturiamo a ore; la cifra oraria sulla nostra riga è il prezzo mensile diviso per 730, mostrata solo per permettere il confronto tra le colonne.
L’aritmetica
Tre righe, che vale la pena scrivere per esteso perché è la seconda quella in cui la maggior parte delle stime sbaglia.
break_even_hours = monthly_price / hourly_price
# For this card, against a $2.99/hour cloud:
$1,469 / $2.99 = 492 hours = 20.5 days
# The mistake: counting only the hours you compute.
# The meter runs while the machine exists, not while it works.
hours_billed = hours_the_instance_is_running # not hours of useful work
Un mese sono 730 ore. Se la sua macchina deve esistere per più di circa 20 giorni su trenta, una durata mensile è più economica — e ogni ora oltre quel punto è puro risparmio.
Cosa nasconde un prezzo orario
La tariffa pubblicata è la parte che può confrontare. Questi tre sono la parte che non può confrontare, e insieme di solito contano più della tariffa stessa.
Storage fatturato separatamente
Sulla maggior parte delle piattaforme a ore il disco è una voce di costo separata, fatturata per GB al mese, e continua a essere fatturata anche quando l’istanza è ferma. Un dataset da 2 TB può silenziosamente costare più della GPU in un mese di scarso utilizzo.
Qui: 2 × 2 TB NVMe è incluso nel prezzo, e nulla viene misurato a consumo.
Traffico in uscita
Far uscire i pesi del suo modello, i checkpoint o l’output generato viene fatturato per gigabyte quasi ovunque. È il costo che compare solo quando il lavoro va a buon fine.
Qui: 1 Gbit/s, senza contatore, in entrambe le direzioni, nessuna eccedenza a qualsiasi volume.
Avvio a freddo ed espulsione
Scaricare un modello da 140 GB su un’istanza nuova richiede da quindici a quaranta minuti che paga senza ottenere nulla in cambio. Sui livelli interrompibili lo paga di nuovo ogni volta che viene espulso a metà esecuzione.
Qui: la macchina è sua per tutta la durata. I pesi sono sui suoi dischi e vi restano.
La trappola del tempo inattivo
È questo che trasforma una stima accurata in un conto tre volte più alto. La fatturazione al secondo sembra sicura perché può fermare l’istanza — e quasi nessuno lo fa, perché fermarla significa perdere lo stato che contiene.
| La macchina è in funzione | Ore | A $2.99/h | Il nostro mensile | Più economico |
|---|---|---|---|---|
| Poche ore a settimana | 12 h | $36 | $1,469 | Orario, per $1,433 |
| Orario lavorativo, giorni feriali | 176 h | $526 | $1,469 | Orario, per $943 |
| Ogni giorno, orario di lavoro | 240 h | $718 | $1,469 | Orario, per $751 |
| Continuously | 730 h | $2,183 | $1,469 | Mensile, per $714 |
Legga con attenzione la seconda riga. «Orario di lavoro, giorni feriali» sembra modesto ed è già dalla parte sbagliata della soglia — e presuppone che lei fermi diligentemente l’istanza ogni sera, il che richiede che su di essa non risieda nulla a cui lei tenga.
Durate più lunghe
Se la risposta è «per un anno», nemmeno il prezzo mensile è il migliore disponibile. La stessa scheda sulle nostre tre durate:
| Durata | Al mese | Pagato in anticipo | Risparmiato in un anno | Compromesso |
|---|---|---|---|---|
| Mensile | $1,469 | $1,469 | — | Nessuno. Annulli prima della data di rinnovo e si ferma semplicemente. |
| 3 mesi | $1,396 | $4,188 | $876 | Pagato in anticipo, non rimborsato pro rata. È questo che si ottiene con lo sconto. |
| 12 mesi | $1,293 | $15,516 | $2,112 | Pagato in anticipo, non rimborsato pro rata. È questo che si ottiene con lo sconto. |
Quando l’orario è davvero la scelta giusta
Non vendiamo a ore, quindi prenda questo per quello che è: i casi in cui dovrebbe rivolgersi altrove.
Un lavoro che finisce oggi. Un fine-tuning, un benchmark, un render. Lo noleggi a ore, paghi quattro ore, ed è fatto.
Un carico realmente discontinuo, che tollera l’espulsione. Se il suo lavoro esegue checkpoint in modo pulito e può essere interrotto a metà esecuzione, la capacità interrompibile è drasticamente più economica di qualsiasi soluzione dedicata.
Ha bisogno di otto schede per sei ore, una tantum. Una durata mensile su un nodo a 8 GPU per eseguire un solo esperimento è la scelta di acquisto sbagliata.
Non lo sa ancora. Noleggi a ore finché il grafico di utilizzo non le dice di cosa ha davvero bisogno, poi torni con un numero.
In tutti gli altri casi — un endpoint che deve rispondere, un modello con cui convive per un trimestre, una scheda che vuole tenere caricata — un mese costa meno del contatore e si comporta meglio. E a differenza di uno sconto per uso vincolato, qui una durata mensile non richiede contratto, né azienda, né verifica d’identità: è un solo pagamento e la macchina è sua.
Ogni prezzo del catalogo è un prezzo mensile.
Nessun contatore, nessun costo per il traffico in uscita, nessuna voce di costo per lo storage, e nessun costo di attivazione da aggiungere.
Altre guide
- Costo · 9 min
Self-hosting contro un’API a pagamento per token
Il break-even tra pagare un’API a token e noleggiare una GPU, calcolato sui nostri prezzi e sul nostro throughput — e le quattro cose che l’aritmetica non considera.
Leggi la guida - Pratica · 11 min
Servire Llama 3.3 70B su un nodo
Da una macchina consegnata a un endpoint compatibile con OpenAI, con i flag che contano e i due che dimezzano in silenzio il throughput.
Leggi la guida - Pratica · 10 min
Fine-tuning di un modello da 70B su una scheda
QLoRA su una sola GPU da 48 GB: cosa ci sta, quanto costa al mese, e perché il fine-tuning completo richiede una macchina di un altro livello.
Leggi la guida