Tutti i 6 data center operativi

Pagamento in cripto · Nessuna verifica d’identità · Accesso root in in meno di 5 minuti

Ada Lovelace · Scheda PCIe

Noleggi un server GPU L40S dedicato.

48 GB di GDDR6 ECC a 864 GB/s, in una macchina tutta sua. Mensile, pagata in cripto, aperta senza verifica d’identità e consegnata in under 5 minutes.

  • $714/mouna scheda, tutto incluso
  • 48 GBGDDR6 ECC
  • 864 GB/slarghezza di banda della memoria
  • 1×, 2×, 4×, 8×dimensioni del nodo disponibili

Prezzo, per dimensione del nodo e durata

Un numero per riga, ed è il numero completo: nessun costo di attivazione, nessun costo di reinstallazione, nessun addebito per la banda, nessun piano di supporto. Le durate più lunghe si pagano in anticipo.

Prezzo mensile di un server L40S, per dimensione del nodo e durata
Nodo CPU e memoria Mensile 3 mesi 12 mesi
1 × L40S 48 GB totali · PCIe 5.0 Intel Xeon Silver 4410Y12 core / 24 thread · 128 GB · 2 × 2 TB NVMe $714/mese annullare in qualsiasi momento $678/mese risparmi $108/anno $628/mese risparmi $1,032/anno Configura
2 × L40S 96 GB totali · PCIe 5.0 ×16 Intel Xeon Gold 5416S16 core / 32 thread · 256 GB · 2 × 3.84 TB NVMe $1,427/mese annullare in qualsiasi momento $1,356/mese risparmi $213/anno $1,256/mese risparmi $2,052/anno Configura
4 × L40S 192 GB totali · PCIe 5.0 ×16 2 × Intel Xeon Gold 6438Y+64 core · 512 GB · 4 × 3.84 TB NVMe $2,754/mese annullare in qualsiasi momento $2,616/mese risparmi $414/anno $2,424/mese risparmi $3,960/anno Configura
8 × L40S 384 GB totali · PCIe 5.0 ×16 2 × Intel Xeon Platinum 8462Y+64 core · 1 TB · 8 × 3.84 TB NVMe $5,251/mese annullare in qualsiasi momento $4,988/mese risparmi $789/anno $4,621/mese risparmi $7,560/anno Configura

Ogni configurazione qui sopra è disponibile in tutti i 6 data center, montata in rack e già rodata, con un’immagine pronta da scrivere — per questo la consegna richiede under 5 minutes invece di un giorno lavorativo.

Specifica completa

GPUNVIDIA L40SArchitettura Ada Lovelace, Scheda PCIe add-in.
Memoria48 GB GDDR6 ECC864 GB/s di larghezza di banda — il numero che predice la velocità di generazione, molto meglio di qualsiasi cifra in teraflop.
InterconnessionePCIe 5.0 ×16Peer-to-peer su PCIe. Va bene per un modello per scheda e per il parallelismo a pipeline; più lento di NVLink per il parallelismo tensoriale. Quale le serve per il suo job.
Dimensioni del nodo1 × scheda, 2 × scheda, 4 × scheda, 8 × schedaLe schede PCIe arrivano fino a otto in uno chassis standard, e a dieci solo per le schede a basso consumo.
Storage2 × 2 TB NVMeConsegnato grezzo oltre il volume di sistema — non imponiamo alcun livello RAID. NVMe aggiuntivi e HDD di archiviazione sono opzioni mensili.
Rete1 Gbit/s, senza contatoreIn entrambe le direzioni, senza volume incluso e senza eccedenza a nessun livello di traffico. Un IPv4, un IPv6 /64 instradato, filtraggio DDoS attivo dalla consegna.

Cosa gira su an L40S

Ogni modello qui sotto ci sta su una singola scheda a 8k di contesto — niente sharding, niente interconnessione a cui pensare. La precisione mostrata è la migliore che ci sta; l’aritmetica è nella guida al dimensionamento della VRAM, così può verificarla.

Modelli linguistici che ci stanno su una singola L40S a 8k di contesto
ModelloPrecisione migliore che ci staMemoria necessariaToken/s stimati
Llama 3.1 8B8B di parametri BF16 / FP16Qualità reference 20 GBdi 48 GB ~24
Llama 3.3 70B70B di parametri 4-bit (AWQ, GPTQ)Pesi più piccoli, la cache resta FP16 43 GBdi 48 GB ~11
Qwen 3 32B32B di parametri FP8Quasi reference, Hopper e Blackwell 38 GBdi 48 GB ~12
Mistral Small 24B24B di parametri FP8Quasi reference, Hopper e Blackwell 28 GBdi 48 GB ~16
Gemma 3 27B27B di parametri FP8Quasi reference, Hopper e Blackwell 33 GBdi 48 GB ~14
Phi-4 14B14B di parametri BF16 / FP16Qualità reference 34 GBdi 48 GB ~14

Sul nodo a 8 schede, gli stessi modelli sono ospitati su 384 GB in totale, il che cambia completamente ciò che è possibile — fino a Llama 3.1 405B. Lo sharding ha un costo di sincronizzazione a ogni livello, quindi un modello che ci sta su una scheda dovrebbe restare su una scheda.

Throughput da aspettarsi

La generazione è limitata dalla larghezza di banda della memoria: ogni token richiede di rileggere i pesi attivi. A 864 GB/s, questo pone un tetto che nessuna ottimizzazione può superare.

Le nostre cifre sono un minimo garantito, non una promessa. Le stime in questa pagina sono calibrate su misurazioni pubblicate e sono deliberatamente prudenti — modellano la generazione a flusso singolo. Con il batching continuo sotto vLLM, il valore aggregato tra le richieste concorrenti è più volte superiore. Se un numero qui sembra basso rispetto a un benchmark che ha visto, di solito è questa la differenza.

Confronto con le schede vicine

Le tre schede più vicine a questa per prezzo. La memoria decide cosa si carica; la larghezza di banda decide quanto velocemente risponde.

La L40S a confronto con le tre schede più vicine per prezzo
SchedaMemoriaLarghezza di bandaInterconnessioneDa
L40S Questa paginaAda Lovelace 48 GB 864 GB/s PCIe $714/mese
A100 PCIeAmpere 40 GB 1,555 GB/s PCIe $392/mese
A100 PCIeAmpere 80 GB 1,935 GB/s PCIe $1,091/mese
RTX 5090Blackwell 32 GB 1,792 GB/s PCIe $335/mese

Vedi tutte le 12 schede fianco a fianco, oppure lasci che il configuratore scelga in base al suo modello e alla lunghezza del contesto, invece che al prezzo.

Confronto con altre schede

I confronti che le persone fanno davvero rispetto a an L40S, ciascuno elaborato su prezzo, memoria, larghezza di banda e sui modelli che ci stanno.

Cosa è incluso

  • Nessuna verifica d’identità

    Nessun documento, nessun selfie, nessun numero di telefono, nessuna registrazione della società.

    Nessuna verifica · a qualsiasi spesa

  • L’intera scheda

    La GPU viene passata a una sola macchina, e quella macchina è sua.

    Niente MIG · niente vGPU · niente hypervisor

  • Root e IPMI

    Root completo dal primo minuto, oltre ad accensione remota e virtual media.

    Fuori banda sulla propria VLAN

  • Banda senza contatore

    Nessun volume incluso, nessun livello di eccedenza, niente da monitorare su un grafico.

    Da 1 a 25 Gbit/s · in entrambe le direzioni

  • Nessun costo di attivazione o reinstallazione

    Reinstalli quante volte desidera, con qualsiasi sistema operativo tra quelli offerti.

    $0 · reinstallazioni illimitate

  • Hardware sostituito, veloce

    Da pezzi di ricambio conservati nella stessa sala, a qualsiasi ora, con i dischi lasciati al loro posto.

    Obiettivo di quattro ore · 24/7

Dove può ottenerla

Ogni configurazione L40S è disponibile in tutti i 6 data center. Non esiste una sede dove una scheda costi di più, né una dove non sia disponibile.

AMS Disponibile

Amsterdam

Paesi Bassi

Andata e ritorno7 ms verso Francoforte, 12 ms verso Londra
SedeTier III · 100% eolico
STO Disponibile

Stoccolma

Svezia

Andata e ritorno22 ms verso Francoforte, 31 ms verso Londra
SedeTier III · 100% idroelettrico
ZRH Disponibile

Zurigo

Svizzera

Andata e ritorno9 ms verso Milano, 15 ms verso Francoforte
SedeTier IV · 96% senza emissioni di carbonio
REY Disponibile

Reykjavík

Islanda

Andata e ritorno18 ms verso Londra, 40 ms verso New York
SedeTier III · 100% geotermico + idroelettrico
YUL Disponibile

Montreal

Canada

Andata e ritorno12 ms verso New York, 19 ms verso Toronto
SedeTier III · 99% idroelettrico
SIN Disponibile

Singapore

Singapore

Andata e ritorno38 ms verso Tokyo, 45 ms verso Sydney
SedeTier III · Rete elettrica + compensazione REC

Domande sul server L40S

Quanto costa al mese un server L40S?
Un server L40S a scheda singola costa $714 al mese, con tutto incluso: 128 GB di RAM di sistema, 2 × 2 TB NVMe, 1 Gbit/s senza contatore, un indirizzo IPv4 e un IPv6 /64 instradato. Nessun costo di attivazione e nessun addebito per la banda. I nodi multi-GPU vanno da $1,427 per 2 schede fino a $5,251 per 8.
Quanta VRAM ha la L40S, e cosa ci sta?
48 GB di GDDR6 ECC per scheda, a 864 GB/s. Il modello più grande che ospita su una scheda a 8k di contesto è Llama 3.3 70B (4-bit (AWQ, GPTQ)).Un nodo a 8 schede ha 384 GB in totale, sufficienti per Llama 3.1 405B.
La L40S è dedicata, o condivisa con altri clienti?
Dedicata. La scheda è passata direttamente a un’unica macchina fisica su cui solo lei ha un account — nessun partizionamento MIG, nessun livello vGPU e nessun altro inquilino sullo stesso silicio. Su un nodo multi-GPU ottiene l’intero nodo, incluso il fabric PCIe 5.0 ×16 tra le schede.
Devo verificare la mia identità per noleggiare un L40S?
No. Non c’è caricamento di documenti, non c’è selfie, non c’è numero di telefono e non c’è registrazione della società, a nessun livello di spesa — un nodo a otto schede si apre esattamente alle stesse condizioni della scheda singola più economica. Aprire un account richiede un indirizzo email, una password e un indirizzo di fatturazione, e nulla di tutto ciò viene verificato.
Come pago, e quanto rapidamente viene consegnato il server?
Solo in criptovaluta: Bitcoin, Monero, Ethereum (ERC-20), Tether (ERC-20) e altre. Ogni ricevuta riceve un indirizzo proprio, l’importo è fissato al tasso mostrato al momento dell’emissione, e la macchina viene provisionata alla prima conferma — accesso root in under 5 minutes, a qualsiasi ora.
Posso noleggiare un L40S a ore, invece?
Non qui. Ogni prezzo su questo sito è un prezzo mensile, senza contatore e senza fatturazione al secondo. Rispetto a un tipico cloud a $2.99/ora, una durata mensile diventa più conveniente oltre circa 239 ore in cui la macchina esiste semplicemente — circa 10 giorni su trenta.

An L40S tutta sua, da $714 al mese.

Montata in rack, rodata e pronta in tutti i 6 data center. Paghi in cripto ed è sua in under 5 minutes.

Accedi

Console, ricevute e accesso fuori banda.

Non ha ancora un account?

Non esiste una registrazione separata. Il suo account viene creato mentre effettua il suo primo ordine — sceglie l’email e la password nella fase di pagamento, e la console è già aperta quando lo è la macchina.

Configura un server

Language