Pagamento in cripto · Nessuna verifica d’identità · Accesso root in in meno di 5 minuti
Ada Lovelace · Scheda PCIe
Noleggi un server GPU L4 dedicato.
24 GB di GDDR6 a 300 GB/s, in una macchina tutta sua. Mensile, pagata in cripto, aperta senza verifica d’identità e consegnata in under 5 minutes.
$125/mouna scheda, tutto incluso
24 GBGDDR6
300 GB/slarghezza di banda della memoria
1×, 2×, 4×, 8×, 10×dimensioni del nodo disponibili
Prezzo, per dimensione del nodo e durata
Un numero per riga, ed è il numero completo: nessun costo di attivazione, nessun costo di reinstallazione, nessun addebito per la banda, nessun piano di supporto. Le durate più lunghe si pagano in anticipo.
Prezzo mensile di un server L4, per dimensione del nodo e durata
Ogni configurazione qui sopra è disponibile in tutti i 6 data center, montata in rack e già rodata, con un’immagine pronta da scrivere — per questo la consegna richiede under 5 minutes invece di un giorno lavorativo.
Specifica completa
GPUNVIDIA L4Architettura Ada Lovelace, Scheda PCIe add-in.
Memoria24 GB GDDR6300 GB/s di larghezza di banda — il numero che predice la velocità di generazione, molto meglio di qualsiasi cifra in teraflop.
InterconnessionePCIe 5.0 ×16Peer-to-peer su PCIe. Va bene per un modello per scheda e per il parallelismo a pipeline; più lento di NVLink per il parallelismo tensoriale. Quale le serve per il suo job.
Dimensioni del nodo1 × scheda, 2 × scheda, 4 × scheda, 8 × scheda, 10 × schedaLe schede PCIe arrivano fino a otto in uno chassis standard, e a dieci solo per le schede a basso consumo.
Storage2 × 2 TB NVMeConsegnato grezzo oltre il volume di sistema — non imponiamo alcun livello RAID. NVMe aggiuntivi e HDD di archiviazione sono opzioni mensili.
Rete1 Gbit/s, senza contatoreIn entrambe le direzioni, senza volume incluso e senza eccedenza a nessun livello di traffico. Un IPv4, un IPv6 /64 instradato, filtraggio DDoS attivo dalla consegna.
Cosa gira su an L4
Ogni modello qui sotto ci sta su una singola scheda a 8k di contesto — niente sharding, niente interconnessione a cui pensare. La precisione mostrata è la migliore che ci sta; l’aritmetica è nella guida al dimensionamento della VRAM, così può verificarla.
Modelli linguistici che ci stanno su una singola L4 a 8k di contesto
Modello
Precisione migliore che ci sta
Memoria necessaria
Token/s stimati
Llama 3.1 8B8B di parametri
BF16 / FP16Qualità reference
20 GBdi 24 GB
~8
Qwen 3 32B32B di parametri
4-bit (AWQ, GPTQ)Pesi più piccoli, la cache resta FP16
21 GBdi 24 GB
~8
Mistral Small 24B24B di parametri
4-bit (AWQ, GPTQ)Pesi più piccoli, la cache resta FP16
15 GBdi 24 GB
~11
Gemma 3 27B27B di parametri
4-bit (AWQ, GPTQ)Pesi più piccoli, la cache resta FP16
20 GBdi 24 GB
~10
Phi-4 14B14B di parametri
FP8Quasi reference, Hopper e Blackwell
17 GBdi 24 GB
~10
Sul nodo a 10 schede, gli stessi modelli sono ospitati su 240 GB in totale, il che cambia completamente ciò che è possibile — fino a Llama 3.1 405B. Lo sharding ha un costo di sincronizzazione a ogni livello, quindi un modello che ci sta su una scheda dovrebbe restare su una scheda.
Throughput da aspettarsi
La generazione è limitata dalla larghezza di banda della memoria: ogni token richiede di rileggere i pesi attivi. A 300 GB/s, questo pone un tetto che nessuna ottimizzazione può superare.
Le nostre cifre sono un minimo garantito, non una promessa.
Le stime in questa pagina sono calibrate su misurazioni pubblicate e sono deliberatamente prudenti — modellano la generazione a flusso singolo. Con il batching continuo sotto vLLM, il valore aggregato tra le richieste concorrenti è più volte superiore. Se un numero qui sembra basso rispetto a un benchmark che ha visto, di solito è questa la differenza.
Confronto con le schede vicine
Le tre schede più vicine a questa per prezzo. La memoria decide cosa si carica; la larghezza di banda decide quanto velocemente risponde.
La L4 a confronto con le tre schede più vicine per prezzo
Nessun documento, nessun selfie, nessun numero di telefono, nessuna registrazione della società.
Nessuna verifica · a qualsiasi spesa
L’intera scheda
La GPU viene passata a una sola macchina, e quella macchina è sua.
Niente MIG · niente vGPU · niente hypervisor
Root e IPMI
Root completo dal primo minuto, oltre ad accensione remota e virtual media.
Fuori banda sulla propria VLAN
Banda senza contatore
Nessun volume incluso, nessun livello di eccedenza, niente da monitorare su un grafico.
Da 1 a 25 Gbit/s · in entrambe le direzioni
Nessun costo di attivazione o reinstallazione
Reinstalli quante volte desidera, con qualsiasi sistema operativo tra quelli offerti.
$0 · reinstallazioni illimitate
Hardware sostituito, veloce
Da pezzi di ricambio conservati nella stessa sala, a qualsiasi ora, con i dischi lasciati al loro posto.
Obiettivo di quattro ore · 24/7
Dove può ottenerla
Ogni configurazione L4 è disponibile in tutti i 6 data center. Non esiste una sede dove una scheda costi di più, né una dove non sia disponibile.
AMSDisponibile
Amsterdam
Paesi Bassi
Andata e ritorno7 ms verso Francoforte, 12 ms verso Londra
SedeTier III · 100% eolico
STODisponibile
Stoccolma
Svezia
Andata e ritorno22 ms verso Francoforte, 31 ms verso Londra
SedeTier III · 100% idroelettrico
ZRHDisponibile
Zurigo
Svizzera
Andata e ritorno9 ms verso Milano, 15 ms verso Francoforte
SedeTier IV · 96% senza emissioni di carbonio
REYDisponibile
Reykjavík
Islanda
Andata e ritorno18 ms verso Londra, 40 ms verso New York
SedeTier III · 100% geotermico + idroelettrico
YULDisponibile
Montreal
Canada
Andata e ritorno12 ms verso New York, 19 ms verso Toronto
SedeTier III · 99% idroelettrico
SINDisponibile
Singapore
Singapore
Andata e ritorno38 ms verso Tokyo, 45 ms verso Sydney
SedeTier III · Rete elettrica + compensazione REC
Domande sul server L4
Quanto costa al mese un server L4?
Un server L4 a scheda singola costa $125 al mese, con tutto incluso: 128 GB di RAM di sistema, 2 × 2 TB NVMe, 1 Gbit/s senza contatore, un indirizzo IPv4 e un IPv6 /64 instradato. Nessun costo di attivazione e nessun addebito per la banda. I nodi multi-GPU vanno da $285 per 2 schede fino a $1,371 per 10.
Quanta VRAM ha la L4, e cosa ci sta?
24 GB di GDDR6 per scheda, a 300 GB/s. Il modello più grande che ospita su una scheda a 8k di contesto è Qwen 3 32B (4-bit (AWQ, GPTQ)).Un nodo a 10 schede ha 240 GB in totale, sufficienti per Llama 3.1 405B.
La L4 è dedicata, o condivisa con altri clienti?
Dedicata. La scheda è passata direttamente a un’unica macchina fisica su cui solo lei ha un account — nessun partizionamento MIG, nessun livello vGPU e nessun altro inquilino sullo stesso silicio. Su un nodo multi-GPU ottiene l’intero nodo, incluso il fabric PCIe 5.0 ×16 tra le schede.
Devo verificare la mia identità per noleggiare un L4?
No. Non c’è caricamento di documenti, non c’è selfie, non c’è numero di telefono e non c’è registrazione della società, a nessun livello di spesa — un nodo a otto schede si apre esattamente alle stesse condizioni della scheda singola più economica. Aprire un account richiede un indirizzo email, una password e un indirizzo di fatturazione, e nulla di tutto ciò viene verificato.
Come pago, e quanto rapidamente viene consegnato il server?
Solo in criptovaluta: Bitcoin, Monero, Ethereum (ERC-20), Tether (ERC-20) e altre. Ogni ricevuta riceve un indirizzo proprio, l’importo è fissato al tasso mostrato al momento dell’emissione, e la macchina viene provisionata alla prima conferma — accesso root in under 5 minutes, a qualsiasi ora.
Posso noleggiare un L4 a ore, invece?
Non qui. Ogni prezzo su questo sito è un prezzo mensile, senza contatore e senza fatturazione al secondo. Rispetto a un tipico cloud a $2.99/ora, una durata mensile diventa più conveniente oltre circa 42 ore in cui la macchina esiste semplicemente — circa 2 giorni su trenta.
An L4 tutta sua, da $125 al mese.
Montata in rack, rodata e pronta in tutti i 6 data center. Paghi in cripto ed è sua in under 5 minutes.