Bezahlung in Krypto · Keine Identitätsprüfung · Root-Zugriff in unter 5 Minuten
Ada Lovelace · PCIe-Karte
Mieten Sie einen dedizierten L40S-GPU-Server.
48 GB GDDR6 ECC bei 864 GB/s, in einer Maschine, die ganz allein Ihnen gehört. Monatlich, bezahlt in Krypto, eröffnet ohne Identitätsprüfung und geliefert in under 5 minutes.
$714/moeine Karte, alles inklusive
48 GBGDDR6 ECC
864 GB/sSpeicherbandbreite
1×, 2×, 4×, 8×verfügbare Knotengrößen
Preis, nach Knotengröße und Laufzeit
Eine Zahl pro Zeile, und es ist die gesamte Zahl: keine Einrichtungsgebühr, keine Gebühr für Neuinstallationen, keine Bandbreitenkosten, kein Support-Plan. Längere Laufzeiten werden im Voraus bezahlt.
Monatspreis eines L40S-Servers, nach Knotengröße und Laufzeit
Jede Konfiguration oben ist in allen 6 Rechenzentren verfügbar, im Rack montiert und eingebrannt, mit einem startbereiten Image – deshalb dauert die Lieferung under 5 minutes statt eines Arbeitstages.
Speicher48 GB GDDR6 ECC864 GB/s Bandbreite – die Zahl, die die Generierungsgeschwindigkeit weit besser vorhersagt als jede Teraflop-Angabe.
InterconnectPCIe 5.0 ×16Peer-to-Peer über PCIe. Geeignet für ein Modell pro Karte und für Pipeline-Parallelismus; langsamer als NVLink für Tensor-Parallelismus. Welche Ihr Job braucht.
Knotengrößen1 × Karte, 2 × Karte, 4 × Karte, 8 × KartePCIe-Karten gehen in einem Standardgehäuse bis zu acht, bei Low-Power-Karten bis zu zehn.
Storage2 × 2 TB NVMeÜber das System-Volume hinaus roh übergeben – wir schreiben kein RAID-Level vor. Mehr NVMe und Archiv-HDD sind monatliche Optionen.
Netzwerk1 Gbit/s, ohne VolumenbegrenzungIn beide Richtungen, kein enthaltenes Volumen und kein Mehrverbrauch, unabhängig vom Datenverkehr. Eine IPv4-Adresse, ein geroutetes IPv6-/64, DDoS-Filterung ab Lieferung.
Was auf an L40S läuft
Jedes Modell unten passt bei 8k Kontext auf eine einzelne Karte – kein Sharding, kein Interconnect, um den man sich kümmern müsste. Gezeigt wird die beste Präzision, die passt; die Rechnung steht im Guide zur VRAM-Dimensionierung, damit Sie sie nachprüfen können.
Sprachmodelle, die bei 8k Kontext auf eine einzelne L40S passen
Auf dem 8-Karten-Knoten werden dieselben Modelle über insgesamt 384 GB gehalten, was das Mögliche vollständig verändert – bis zu Llama 3.1 405B. Sharding kostet auf jeder Ebene Synchronisation, daher sollte ein Modell, das auf eine Karte passt, auch auf einer Karte bleiben.
Zu erwartender Durchsatz
Die Generierung wird durch die Speicherbandbreite begrenzt: Jedes Token erfordert das erneute Einlesen der aktiven Gewichte. Bei 864 GB/s setzt das eine Obergrenze, über die kein Tuning hinauskommt.
Unsere Zahlen sind eine Untergrenze, kein Versprechen.
Die Schätzungen auf dieser Seite sind an veröffentlichten Messungen kalibriert und bewusst konservativ – sie bilden die Generierung in einem einzelnen Stream ab. Mit kontinuierlichem Batching unter vLLM liegt das Aggregat über gleichzeitige Anfragen um ein Vielfaches höher. Wenn eine Zahl hier niedrig gegenüber einem Benchmark wirkt, den Sie gesehen haben, ist das meist der Grund.
Im Vergleich mit preislich nahen Karten
Die drei Karten, die dieser preislich am nächsten liegen. Speicher entscheidet, was lädt; Bandbreite entscheidet, wie schnell die Antwort kommt.
Die L40S im Vergleich mit den drei preislich nächsten Karten
Die Abwägungen, die man in der Praxis gegenüber an L40S trifft – jede anhand von Preis, Speicher, Bandbreite und den passenden Modellen durchgerechnet.
Kein Dokument, kein Selfie, keine Telefonnummer, keine Firmenregistrierung.
Nichts verifiziert · bei jedem Ausgabenbetrag
Die ganze Karte
Die GPU wird an eine Maschine durchgereicht, und diese Maschine gehört Ihnen.
Kein MIG · kein vGPU · kein Hypervisor
Root und IPMI
Voller Root-Zugriff ab der ersten Minute, plus Fernzugriff auf Stromversorgung und virtuelle Medien.
Out-of-Band im eigenen VLAN
Bandbreite ohne Volumenbegrenzung
Kein enthaltenes Volumen, keine Mehrverbrauchsstufe, nichts zum Beobachten auf einem Graphen.
1 bis 25 Gbit/s · in beide Richtungen
Keine Einrichtungs- oder Neuinstallationsgebühr
Installieren Sie so oft neu, wie Sie möchten, mit jedem von uns angebotenen Betriebssystem.
$0 · Neuinstallationen unbegrenzt
Hardware ausgetauscht, schnell
Mit Ersatzteilen aus derselben Halle, zu jeder Stunde, Festplatten bleiben an ihrem Platz.
Vier-Stunden-Ziel · 24/7
Wo Sie sie bekommen können
Jede L40S-Konfiguration ist in allen 6 Rechenzentren verfügbar. Es gibt keinen Standort, an dem eine Karte mehr kostet, und keinen, an dem sie nicht verfügbar ist.
AMSVerfügbar
Amsterdam
Niederlande
Laufzeit7 ms nach Frankfurt, 12 ms nach London
StandortTier III · 100 % Windkraft
STOVerfügbar
Stockholm
Schweden
Laufzeit22 ms nach Frankfurt, 31 ms nach London
StandortTier III · 100 % Wasserkraft
ZRHVerfügbar
Zürich
Schweiz
Laufzeit9 ms nach Mailand, 15 ms nach Frankfurt
StandortTier IV · 96 % CO2-frei
REYVerfügbar
Reykjavík
Island
Laufzeit18 ms nach London, 40 ms nach New York
StandortTier III · 100 % Geothermie + Wasserkraft
YULVerfügbar
Montréal
Kanada
Laufzeit12 ms nach New York, 19 ms nach Toronto
StandortTier III · 99 % Wasserkraft
SINVerfügbar
Singapur
Singapur
Laufzeit38 ms nach Tokio, 45 ms nach Sydney
StandortTier III · Stromnetz + REC-Ausgleich
Fragen zum L40S-Server
Wie viel kostet ein L40S-Server pro Monat?
Ein L40S-Server mit einer Karte kostet $714 im Monat, alles inklusive: 128 GB System-RAM, 2 × 2 TB NVMe, 1 Gbit/s ohne Volumenbegrenzung, eine IPv4-Adresse und ein geroutetes IPv6-/64. Es gibt keine Einrichtungsgebühr und keine Kosten für Bandbreite. Multi-GPU-Knoten reichen von $1,427 für 2 Karten bis $5,251 für 8.
Wie viel VRAM hat die L40S, und was passt hinein?
48 GB GDDR6 ECC pro Karte, bei 864 GB/s. Das größte Modell, das sie bei 8k Kontext auf einer Karte fasst, ist Llama 3.3 70B (4-bit (AWQ, GPTQ)).Ein Knoten mit 8 Karten hat insgesamt 384 GB, genug für Llama 3.1 405B.
Ist die L40S dediziert, oder wird sie mit anderen Kunden geteilt?
Dediziert. Die Karte wird direkt an eine einzelne physische Maschine durchgereicht, auf der nur Sie ein Konto haben – kein MIG-Partitioning, keine vGPU-Schicht und kein weiterer Mandant auf demselben Chip. Bei einem Multi-GPU-Knoten erhalten Sie den ganzen Knoten, einschließlich der PCIe 5.0 ×16-Fabric zwischen den Karten.
Muss ich meine Identität verifizieren, um eine L40S zu mieten?
Nein. Es gibt keinen Dokumenten-Upload, kein Selfie, keine Telefonnummer und keine Firmenregistrierung, unabhängig von der Ausgabenhöhe – ein Achtkarten-Knoten wird zu genau denselben Bedingungen eröffnet wie die günstigste Einzelkarte. Für die Kontoeröffnung genügen eine E-Mail-Adresse, ein Passwort und eine Rechnungsadresse, und nichts davon wird geprüft.
Wie bezahle ich, und wie schnell wird der Server geliefert?
Nur in Kryptowährung: Bitcoin, Monero, Ethereum (ERC-20), Tether (ERC-20) und andere. Jede Rechnung erhält eine eigene Adresse, der Betrag wird zum bei Ausstellung angezeigten Kurs fixiert, und die Maschine wird bei der ersten Bestätigung bereitgestellt – Root-Zugriff in under 5 minutes, zu jeder Stunde.
Kann ich eine L40S stattdessen stundenweise mieten?
Hier nicht. Jeder Preis auf dieser Seite ist ein Monatspreis, ohne Zähler und ohne sekundengenaue Abrechnung. Gegenüber einer typischen Cloud zu $2.99/Stunde ist eine monatliche Laufzeit günstiger, sobald die Maschine rund 239 Stunden lang einfach existiert – etwa 10 von dreißig Tagen.
An L40S nur für Sie, ab $714 im Monat.
Im Rack montiert, eingebrannt und einsatzbereit in allen 6 Rechenzentren. Zahlen Sie in Krypto, und er gehört in under 5 minutes Ihnen.