Guide.
Approfondimenti sulle domande che decidono quale macchina noleggiare — scritti confrontandoci con l’hardware che gestiamo davvero, calcoli inclusi.
- Scritto sull’hardware che gestiamo
- Comandi che può incollare, non pseudocodice
- Aritmetica mostrata, così può verificarla
Tutte le 10 guide
5 on dimensionamento · 2 on costo · 2 on pratica · 1 on pagamento
-
Dimensionamento · 9 min
Quanta VRAM serve davvero a un modello
L’aritmetica dietro «ci sta»: pesi, cache KV, e i due punti dove una regola empirica sbaglia di un fattore tre.
Leggi la guida -
Dimensionamento · 7 min
NVLink o PCIe: quale serve al carico di lavoro
Quando il collegamento tra le schede decide il throughput, quando non cambia nulla, e come capire in quale caso ci si trova prima di pagare per il nodo sbagliato.
Leggi la guida -
Dimensionamento · 9 min
Scegliere una scheda per modelli di immagine e video
Quanta VRAM richiedono FLUX, SDXL, SD 3.5 e Wan 2.1, quale scheda del catalogo li ospita, e perché la più economica che ci sta è raramente quella da noleggiare.
Leggi la guida -
Dimensionamento · 10 min
Scegliere un formato di quantizzazione
Quanto costano AWQ, GPTQ, GGUF e FP8 in memoria, velocità e qualità — e perché il formato con i pesi più piccoli raramente dà il modello più piccolo.
Leggi la guida -
Dimensionamento · 10 min
Eseguire un modello mixture-of-experts
I parametri totali decidono la macchina, i parametri attivi decidono la velocità. Quanta VRAM serve a DeepSeek V3 e Qwen 3 235B, e quale nodo noleggiare per loro.
Leggi la guida -
Costo · 6 min
Quando il noleggio mensile batte quello orario
Il break-even calcolato su numeri reali, i tre costi che un prezzo orario nasconde fino alla ricevuta, e la trappola dei tempi morti che triplica una stima.
Leggi la guida -
Costo · 9 min
Self-hosting contro un’API a pagamento per token
Il break-even tra pagare un’API a token e noleggiare una GPU, calcolato sui nostri prezzi e sul nostro throughput — e le quattro cose che l’aritmetica non considera.
Leggi la guida -
Pratica · 11 min
Servire Llama 3.3 70B su un nodo
Da una macchina consegnata a un endpoint compatibile con OpenAI, con i flag che contano e i due che dimezzano in silenzio il throughput.
Leggi la guida -
Pratica · 10 min
Fine-tuning di un modello da 70B su una scheda
QLoRA su una sola GPU da 48 GB: cosa ci sta, quanto costa al mese, e perché il fine-tuning completo richiede una macchina di un altro livello.
Leggi la guida -
Pagamento · 8 min
Pagare un server in cripto
Cosa succede realmente tra il clic su paga e l’ottenimento del root, quale moneta scegliere, e i quattro errori che fanno perdere denaro al primo pagamento.
Leggi la guida
Ten domande decidono quale macchina dovrebbe noleggiare.
Preferiamo scrivere ten articoli che rispondono a una domanda reale piuttosto che sessanta che si posizionano per un termine di ricerca. Ogni guida qui sopra esiste perché è una domanda che ci viene posta prima di un ordine, e ciascuna è scritta sulla base delle schede nel nostro catalogo — i numeri che contiene sono numeri di macchine che gestiamo.
Dove una guida mostra una formula, è la stessa formula che il configuratore usa per dirle se un modello ci sta. È deliberato: dovrebbe poter verificare la nostra aritmetica, invece di fidarsi del segno di spunta verde.
Dritto al punto
Se già sa cosa le serve
Ogni guida finisce nello stesso punto.
Una macchina che può noleggiare al mese, pagare in cripto, e aprire senza dover dimostrare chi è.