Pagamento in cripto · Nessuna verifica d’identità · Accesso root in in meno di 5 minuti
Ada Lovelace · Scheda PCIe
Noleggi un server GPU L40S dedicato.
48 GB di GDDR6 ECC a 864 GB/s, in una macchina tutta sua. Mensile, pagata in cripto, aperta senza verifica d’identità e consegnata in under 5 minutes.
$714/mouna scheda, tutto incluso
48 GBGDDR6 ECC
864 GB/slarghezza di banda della memoria
1×, 2×, 4×, 8×dimensioni del nodo disponibili
Prezzo, per dimensione del nodo e durata
Un numero per riga, ed è il numero completo: nessun costo di attivazione, nessun costo di reinstallazione, nessun addebito per la banda, nessun piano di supporto. Le durate più lunghe si pagano in anticipo.
Prezzo mensile di un server L40S, per dimensione del nodo e durata
Ogni configurazione qui sopra è disponibile in tutti i 6 data center, montata in rack e già rodata, con un’immagine pronta da scrivere — per questo la consegna richiede under 5 minutes invece di un giorno lavorativo.
Specifica completa
GPUNVIDIA L40SArchitettura Ada Lovelace, Scheda PCIe add-in.
Memoria48 GB GDDR6 ECC864 GB/s di larghezza di banda — il numero che predice la velocità di generazione, molto meglio di qualsiasi cifra in teraflop.
InterconnessionePCIe 5.0 ×16Peer-to-peer su PCIe. Va bene per un modello per scheda e per il parallelismo a pipeline; più lento di NVLink per il parallelismo tensoriale. Quale le serve per il suo job.
Dimensioni del nodo1 × scheda, 2 × scheda, 4 × scheda, 8 × schedaLe schede PCIe arrivano fino a otto in uno chassis standard, e a dieci solo per le schede a basso consumo.
Storage2 × 2 TB NVMeConsegnato grezzo oltre il volume di sistema — non imponiamo alcun livello RAID. NVMe aggiuntivi e HDD di archiviazione sono opzioni mensili.
Rete1 Gbit/s, senza contatoreIn entrambe le direzioni, senza volume incluso e senza eccedenza a nessun livello di traffico. Un IPv4, un IPv6 /64 instradato, filtraggio DDoS attivo dalla consegna.
Cosa gira su an L40S
Ogni modello qui sotto ci sta su una singola scheda a 8k di contesto — niente sharding, niente interconnessione a cui pensare. La precisione mostrata è la migliore che ci sta; l’aritmetica è nella guida al dimensionamento della VRAM, così può verificarla.
Modelli linguistici che ci stanno su una singola L40S a 8k di contesto
Modello
Precisione migliore che ci sta
Memoria necessaria
Token/s stimati
Llama 3.1 8B8B di parametri
BF16 / FP16Qualità reference
20 GBdi 48 GB
~24
Llama 3.3 70B70B di parametri
4-bit (AWQ, GPTQ)Pesi più piccoli, la cache resta FP16
43 GBdi 48 GB
~11
Qwen 3 32B32B di parametri
FP8Quasi reference, Hopper e Blackwell
38 GBdi 48 GB
~12
Mistral Small 24B24B di parametri
FP8Quasi reference, Hopper e Blackwell
28 GBdi 48 GB
~16
Gemma 3 27B27B di parametri
FP8Quasi reference, Hopper e Blackwell
33 GBdi 48 GB
~14
Phi-4 14B14B di parametri
BF16 / FP16Qualità reference
34 GBdi 48 GB
~14
Sul nodo a 8 schede, gli stessi modelli sono ospitati su 384 GB in totale, il che cambia completamente ciò che è possibile — fino a Llama 3.1 405B. Lo sharding ha un costo di sincronizzazione a ogni livello, quindi un modello che ci sta su una scheda dovrebbe restare su una scheda.
Throughput da aspettarsi
La generazione è limitata dalla larghezza di banda della memoria: ogni token richiede di rileggere i pesi attivi. A 864 GB/s, questo pone un tetto che nessuna ottimizzazione può superare.
Le nostre cifre sono un minimo garantito, non una promessa.
Le stime in questa pagina sono calibrate su misurazioni pubblicate e sono deliberatamente prudenti — modellano la generazione a flusso singolo. Con il batching continuo sotto vLLM, il valore aggregato tra le richieste concorrenti è più volte superiore. Se un numero qui sembra basso rispetto a un benchmark che ha visto, di solito è questa la differenza.
Confronto con le schede vicine
Le tre schede più vicine a questa per prezzo. La memoria decide cosa si carica; la larghezza di banda decide quanto velocemente risponde.
La L40S a confronto con le tre schede più vicine per prezzo
Nessun documento, nessun selfie, nessun numero di telefono, nessuna registrazione della società.
Nessuna verifica · a qualsiasi spesa
L’intera scheda
La GPU viene passata a una sola macchina, e quella macchina è sua.
Niente MIG · niente vGPU · niente hypervisor
Root e IPMI
Root completo dal primo minuto, oltre ad accensione remota e virtual media.
Fuori banda sulla propria VLAN
Banda senza contatore
Nessun volume incluso, nessun livello di eccedenza, niente da monitorare su un grafico.
Da 1 a 25 Gbit/s · in entrambe le direzioni
Nessun costo di attivazione o reinstallazione
Reinstalli quante volte desidera, con qualsiasi sistema operativo tra quelli offerti.
$0 · reinstallazioni illimitate
Hardware sostituito, veloce
Da pezzi di ricambio conservati nella stessa sala, a qualsiasi ora, con i dischi lasciati al loro posto.
Obiettivo di quattro ore · 24/7
Dove può ottenerla
Ogni configurazione L40S è disponibile in tutti i 6 data center. Non esiste una sede dove una scheda costi di più, né una dove non sia disponibile.
AMSDisponibile
Amsterdam
Paesi Bassi
Andata e ritorno7 ms verso Francoforte, 12 ms verso Londra
SedeTier III · 100% eolico
STODisponibile
Stoccolma
Svezia
Andata e ritorno22 ms verso Francoforte, 31 ms verso Londra
SedeTier III · 100% idroelettrico
ZRHDisponibile
Zurigo
Svizzera
Andata e ritorno9 ms verso Milano, 15 ms verso Francoforte
SedeTier IV · 96% senza emissioni di carbonio
REYDisponibile
Reykjavík
Islanda
Andata e ritorno18 ms verso Londra, 40 ms verso New York
SedeTier III · 100% geotermico + idroelettrico
YULDisponibile
Montreal
Canada
Andata e ritorno12 ms verso New York, 19 ms verso Toronto
SedeTier III · 99% idroelettrico
SINDisponibile
Singapore
Singapore
Andata e ritorno38 ms verso Tokyo, 45 ms verso Sydney
SedeTier III · Rete elettrica + compensazione REC
Domande sul server L40S
Quanto costa al mese un server L40S?
Un server L40S a scheda singola costa $714 al mese, con tutto incluso: 128 GB di RAM di sistema, 2 × 2 TB NVMe, 1 Gbit/s senza contatore, un indirizzo IPv4 e un IPv6 /64 instradato. Nessun costo di attivazione e nessun addebito per la banda. I nodi multi-GPU vanno da $1,427 per 2 schede fino a $5,251 per 8.
Quanta VRAM ha la L40S, e cosa ci sta?
48 GB di GDDR6 ECC per scheda, a 864 GB/s. Il modello più grande che ospita su una scheda a 8k di contesto è Llama 3.3 70B (4-bit (AWQ, GPTQ)).Un nodo a 8 schede ha 384 GB in totale, sufficienti per Llama 3.1 405B.
La L40S è dedicata, o condivisa con altri clienti?
Dedicata. La scheda è passata direttamente a un’unica macchina fisica su cui solo lei ha un account — nessun partizionamento MIG, nessun livello vGPU e nessun altro inquilino sullo stesso silicio. Su un nodo multi-GPU ottiene l’intero nodo, incluso il fabric PCIe 5.0 ×16 tra le schede.
Devo verificare la mia identità per noleggiare un L40S?
No. Non c’è caricamento di documenti, non c’è selfie, non c’è numero di telefono e non c’è registrazione della società, a nessun livello di spesa — un nodo a otto schede si apre esattamente alle stesse condizioni della scheda singola più economica. Aprire un account richiede un indirizzo email, una password e un indirizzo di fatturazione, e nulla di tutto ciò viene verificato.
Come pago, e quanto rapidamente viene consegnato il server?
Solo in criptovaluta: Bitcoin, Monero, Ethereum (ERC-20), Tether (ERC-20) e altre. Ogni ricevuta riceve un indirizzo proprio, l’importo è fissato al tasso mostrato al momento dell’emissione, e la macchina viene provisionata alla prima conferma — accesso root in under 5 minutes, a qualsiasi ora.
Posso noleggiare un L40S a ore, invece?
Non qui. Ogni prezzo su questo sito è un prezzo mensile, senza contatore e senza fatturazione al secondo. Rispetto a un tipico cloud a $2.99/ora, una durata mensile diventa più conveniente oltre circa 239 ore in cui la macchina esiste semplicemente — circa 10 giorni su trenta.
An L40S tutta sua, da $714 al mese.
Montata in rack, rodata e pronta in tutti i 6 data center. Paghi in cripto ed è sua in under 5 minutes.