Le macchine che Le noleggiamo sono nostre.
gpuserver.io è un piccolo operatore indipendente. Compriamo le schede, le montiamo in rack in sale prese in affitto, e le noleggiamo al mese. Qui nulla è rivenduto dal cloud di qualcun altro, ed è l’unico motivo per cui possiamo promettere che la specifica indicata in una riga è la specifica che riceve.
- 6data center, tutte sale in affitto
- 12Modelli di GPU, tutti acquistati nuovi
- 41configurazioni, tutte disponibili
- 0schede rivendute da un altro cloud
Noleggiare una GPU era diventato il modo più complicato di comprare potenza di calcolo.
Abbiamo iniziato perché eravamo prima di tutto clienti, e perché ogni opzione davanti a noi sbagliava allo stesso modo, per tre motivi.
Gli hyperscaler volevano una registrazione societaria, un controllo del credito e una richiesta di quota prima di lasciarci avvicinare a una A100 — e poi fatturavano al secondo una macchina che intendevamo tenere per un anno. I marketplace erano più economici, ma la scheda era il desktop di scorta di qualcuno dietro una linea residenziale, e il nodo spariva a metà esecuzione. I cloud specializzati erano onesti e validi, con prezzi come se una GPU fosse un metallo raro.
Nessuno di loro ci avrebbe semplicemente noleggiato una macchina per un mese, preso il pagamento e consegnato il root. Così abbiamo comprato l’hardware e lo abbiamo fatto noi.
Cosa abbiamo deciso, in ordine
E in quest’ordine, perché ciascuna vincola la successiva
Possedere le schede è ciò che rende possibili le altre tre cose. Un rivenditore non può promettere una specifica che non controlla, e non può rifiutare un requisito KYC imposto da chi gli vende.
Quattro cose che non pieghiamo mai, anche quando ci costa.
Ognuna di queste regole ci è già costata una vendita. Sono su questa pagina perché possa farcele rispettare.
Nessuna identità, mai
Non alla registrazione, non al rinnovo, e non quando la spesa cresce. Non esiste un livello di verifica: un nodo a otto GPU si apre esattamente alle stesse condizioni della scheda singola più economica.
- Nessun documento, nessun selfie, nessun numero di telefono
- Nulla di quanto si scrive viene verificato con alcunché
- Nessuna soglia che attivi una revisione
Il prezzo è il prezzo
Un solo numero per configurazione, per durata. Nessun costo di attivazione, nessun costo di reinstallazione, nessuna eccedenza di banda, nessun piano di supporto, e nessuno sconto che compare solo se lo chiede.
- Nulla viene misurato dopo la ricevuta
- Lo stesso prezzo per chiunque
- Annullare una durata mensile senza penali
L’inserzione è la macchina
Se non possiamo consegnare esattamente la scheda indicata nella riga, glielo diciamo e rimborsiamo la durata. Non spediamo un quasi-equivalente sperando che la differenza passi inosservata.
- Un inquilino per scheda fisica
- Nessun MIG, nessuna vGPU, nessun hypervisor
- Numeri di serie registrati per chassis
Conserviamo il minimo indispensabile
Conserviamo ciò che il servizio crea e nient’altro, perché i dati che non abbiamo sono dati che nessuno può costringerci a produrre. I dischi vengono cancellati tra un inquilino e l’altro, senza che nessuno lo chieda.
- Nessun login all’interno del suo sistema operativo
- Nessun backup dei suoi dischi
- Nulla viene conservato oltre la durata dichiarata
Una sala alla volta.
Non abbiamo mai raccolto capitali e non abbiamo mai comprato capacità che non potevamo riempire. Ogni sede qui sotto è stata aperta con i ricavi della precedente, il che è più lento dell’alternativa, ed è il motivo per cui siamo ancora qui.
2021 · AMS
Amsterdam, Paesi Bassi
Tier III, 100% eolico. La prima sala, e ancora la più grande. Tutto ciò che abbiamo imparato sul rodaggio lo abbiamo imparato qui, per lo più sbagliando.
2022 · STO
Stoccolma, Svezia
Tier III, 100% idroelettrico. Aperta secondo lo stesso schema delle altre: due carrier, un exchange pubblico, ricambi in sede, e nessuna macchina venduta prima di aver superato tre giorni di carico.
2023 · ZRH
Zurigo, Svizzera
Tier IV, 96% senza emissioni di carbonio. Aperta secondo lo stesso schema delle altre: due carrier, un exchange pubblico, ricambi in sede, e nessuna macchina venduta prima di aver superato tre giorni di carico.
2023 · YUL
Montreal, Canada
Tier III, 99% idroelettrico. Aperta secondo lo stesso schema delle altre: due carrier, un exchange pubblico, ricambi in sede, e nessuna macchina venduta prima di aver superato tre giorni di carico.
2024 · REY
Reykjavík, Islanda
Tier III, 100% geotermico + idroelettrico. Aperta secondo lo stesso schema delle altre: due carrier, un exchange pubblico, ricambi in sede, e nessuna macchina venduta prima di aver superato tre giorni di carico.
2025 · SIN
Singapore, Singapore
Tier III, Rete elettrica + compensazione REC. Aperta secondo lo stesso schema delle altre: due carrier, un exchange pubblico, ricambi in sede, e nessuna macchina venduta prima di aver superato tre giorni di carico.
Cosa non siamo.
Metà della scelta di un provider consiste nell’escluderne rapidamente uno. Ecco tutto ciò che dovrebbe escludere noi.
Non un cloud. Non c’è console, non c’è autoscaling, non c’è database gestito e non c’è object store. Riceve una macchina e il root su di essa.
Non un marketplace. Qui nessuno mette in vendita il proprio desktop di scorta. Ogni scheda è nostra, in un data center, su un uplink in linea dedicata.
Non a ore. Se ha bisogno di una scheda per due ore a settimana, siamo l’opzione costosa e dovrebbe usare un provider a consumo al secondo.
Non un cluster di training. NVLink collega le schede all’interno di un nodo. Non vendiamo un fabric tra nodi, quindi un carico di lavoro che richiede 32 GPU in un’unica esecuzione non fa per noi.
Non un servizio di anonimato. Nessuna verifica d’identità non equivale a nessuna traccia. La sua macchina ha un indirizzo pubblico e il suo traffico va dove lo invia.
Non senza regole. Non chiediamo chi è, il che rende più importante agire su ciò che fa una macchina. La politica di uso accettabile è breve e viene applicata.
Chi risponde è la stessa persona che ha la scheda di scorta.
Qui non esiste un primo livello né una gerarchia di ticket, perché non siamo abbastanza numerosi per averne una. Un messaggio su una GPU che va in throttling raggiunge qualcuno che può letteralmente camminare fino al rack.
Questo ha un costo, e preferiamo dichiararlo piuttosto che abbellirlo: siamo piccoli. Non gestiamo una linea telefonica, non offriamo un account manager dedicato, e se ha bisogno di un processo di procurement con un accordo quadro firmato, non siamo strutturati per offrirlo.
Ciò che offriamo è che la risposta che riceve viene da chi conosce la macchina, e che di solito arriva entro un’ora.
Ingegneria, non supporto
Chiunque risponda a un messaggio monta anche hardware in rack. Per questo una risposta sulla topologia NVLink è specifica, e non un link a una knowledge base.
24 ore su 24, onestamente
I guasti hardware vengono gestiti a qualsiasi ora, con un obiettivo di quattro ore. Le domande non urgenti ricevono risposta durante l’orario diurno in Europa, e preferiamo dirlo apertamente piuttosto che fingere.
Per iscritto, in inglese
Un solo canale, un solo thread, niente telefonate a vuoto. Tutto ciò che le diciamo sulla sua macchina viene messo per iscritto dove può tornare a consultarlo.
Le macchine sono già montate in rack.
Ogni configurazione del catalogo è alimentata, sottoposta a rodaggio e pronta in tutte le 6 sale. Nulla viene costruito su richiesta, ed è per questo che il root arriva in in meno di 5 minuti.
Pagine correlate
- Politica hardwareLe dodici GPU NVIDIA che gestiamo, il rodaggio di 72 ore prima della vendita, la sostituzione in 4 ore, e come cancelliamo i dischi tra un inquilino e l’altro.
- RetePorte senza contatore fino a 25 Gbit/s, due carrier e un IX per sede, DDoS sempre filtrato, IPv6 instradato — e quattro cose che non offriamo, dette subito.
- Uso accettabileCosa si può e non si può eseguire su una macchina gpuserver.io, cosa è consentito, cosa chiedere prima, e la procedura quando una macchina supera il limite.
- GuideOtto guide pratiche: dimensionamento VRAM, NVLink contro PCIe, modelli immagine e video, mensile contro orario, self-hosting contro API, serving Llama 70B e QLoRA.