Alle 6 Rechenzentren betriebsbereit

Bezahlung in Krypto · Keine Identitätsprüfung · Root-Zugriff in unter 5 Minuten

Ada Lovelace · PCIe-Karte

Mieten Sie einen dedizierten L4-GPU-Server.

24 GB GDDR6 bei 300 GB/s, in einer Maschine, die ganz allein Ihnen gehört. Monatlich, bezahlt in Krypto, eröffnet ohne Identitätsprüfung und geliefert in under 5 minutes.

  • $125/moeine Karte, alles inklusive
  • 24 GBGDDR6
  • 300 GB/sSpeicherbandbreite
  • 1×, 2×, 4×, 8×, 10×verfügbare Knotengrößen

Preis, nach Knotengröße und Laufzeit

Eine Zahl pro Zeile, und es ist die gesamte Zahl: keine Einrichtungsgebühr, keine Gebühr für Neuinstallationen, keine Bandbreitenkosten, kein Support-Plan. Längere Laufzeiten werden im Voraus bezahlt.

Monatspreis eines L4-Servers, nach Knotengröße und Laufzeit
Knoten CPU und Arbeitsspeicher Monatlich 3 Monate 12 Monate
1 × L4 24 GB insgesamt · PCIe 5.0 Intel Xeon Silver 4410Y12 Kerne / 24 Threads · 128 GB · 2 × 2 TB NVMe $125/Monat jederzeit kündbar $119/Monat $18/Jahr sparen $110/Monat $180/Jahr sparen Konfigurieren
2 × L4 48 GB insgesamt · PCIe 5.0 ×16 Intel Xeon Gold 5416S16 Kerne / 32 Threads · 256 GB · 2 × 3.84 TB NVMe $285/Monat jederzeit kündbar $271/Monat $42/Jahr sparen $251/Monat $408/Jahr sparen Konfigurieren
4 × L4 96 GB insgesamt · PCIe 5.0 ×16 2 × Intel Xeon Gold 6438Y+64 Kerne · 512 GB · 4 × 3.84 TB NVMe $564/Monat jederzeit kündbar $536/Monat $84/Jahr sparen $496/Monat $816/Jahr sparen Konfigurieren
8 × L4 192 GB insgesamt · PCIe 5.0 ×16 2 × Intel Xeon Platinum 8462Y+64 Kerne · 1 TB · 8 × 3.84 TB NVMe $1,106/Monat jederzeit kündbar $1,051/Monat $165/Jahr sparen $973/Monat $1,596/Jahr sparen Konfigurieren
10 × L4 240 GB insgesamt · PCIe 5.0 ×16 2 × Intel Xeon Platinum 8462Y+64 Kerne · 1 TB · 8 × 7.68 TB NVMe $1,371/Monat jederzeit kündbar $1,302/Monat $207/Jahr sparen $1,206/Monat $1,980/Jahr sparen Konfigurieren

Jede Konfiguration oben ist in allen 6 Rechenzentren verfügbar, im Rack montiert und eingebrannt, mit einem startbereiten Image – deshalb dauert die Lieferung under 5 minutes statt eines Arbeitstages.

Vollständige Spezifikation

GPUNVIDIA L4Ada Lovelace-Architektur, PCIe-Steckkarte.
Speicher24 GB GDDR6300 GB/s Bandbreite – die Zahl, die die Generierungsgeschwindigkeit weit besser vorhersagt als jede Teraflop-Angabe.
InterconnectPCIe 5.0 ×16Peer-to-Peer über PCIe. Geeignet für ein Modell pro Karte und für Pipeline-Parallelismus; langsamer als NVLink für Tensor-Parallelismus. Welche Ihr Job braucht.
Knotengrößen1 × Karte, 2 × Karte, 4 × Karte, 8 × Karte, 10 × KartePCIe-Karten gehen in einem Standardgehäuse bis zu acht, bei Low-Power-Karten bis zu zehn.
Storage2 × 2 TB NVMeÜber das System-Volume hinaus roh übergeben – wir schreiben kein RAID-Level vor. Mehr NVMe und Archiv-HDD sind monatliche Optionen.
Netzwerk1 Gbit/s, ohne VolumenbegrenzungIn beide Richtungen, kein enthaltenes Volumen und kein Mehrverbrauch, unabhängig vom Datenverkehr. Eine IPv4-Adresse, ein geroutetes IPv6-/64, DDoS-Filterung ab Lieferung.

Was auf an L4 läuft

Jedes Modell unten passt bei 8k Kontext auf eine einzelne Karte – kein Sharding, kein Interconnect, um den man sich kümmern müsste. Gezeigt wird die beste Präzision, die passt; die Rechnung steht im Guide zur VRAM-Dimensionierung, damit Sie sie nachprüfen können.

Sprachmodelle, die bei 8k Kontext auf eine einzelne L4 passen
ModellBeste Präzision, die passtBenötigter SpeicherGeschätzte Token/s
Llama 3.1 8B8B Parameter BF16 / FP16Referenzqualität 20 GBvon 24 GB ~8
Qwen 3 32B32B Parameter 4-bit (AWQ, GPTQ)Kleinste Gewichte, Cache bleibt FP16 21 GBvon 24 GB ~8
Mistral Small 24B24B Parameter 4-bit (AWQ, GPTQ)Kleinste Gewichte, Cache bleibt FP16 15 GBvon 24 GB ~11
Gemma 3 27B27B Parameter 4-bit (AWQ, GPTQ)Kleinste Gewichte, Cache bleibt FP16 20 GBvon 24 GB ~10
Phi-4 14B14B Parameter FP8Nahe am Referenzdesign, Hopper und Blackwell 17 GBvon 24 GB ~10

Auf dem 10-Karten-Knoten werden dieselben Modelle über insgesamt 240 GB gehalten, was das Mögliche vollständig verändert – bis zu Llama 3.1 405B. Sharding kostet auf jeder Ebene Synchronisation, daher sollte ein Modell, das auf eine Karte passt, auch auf einer Karte bleiben.

Zu erwartender Durchsatz

Die Generierung wird durch die Speicherbandbreite begrenzt: Jedes Token erfordert das erneute Einlesen der aktiven Gewichte. Bei 300 GB/s setzt das eine Obergrenze, über die kein Tuning hinauskommt.

Unsere Zahlen sind eine Untergrenze, kein Versprechen. Die Schätzungen auf dieser Seite sind an veröffentlichten Messungen kalibriert und bewusst konservativ – sie bilden die Generierung in einem einzelnen Stream ab. Mit kontinuierlichem Batching unter vLLM liegt das Aggregat über gleichzeitige Anfragen um ein Vielfaches höher. Wenn eine Zahl hier niedrig gegenüber einem Benchmark wirkt, den Sie gesehen haben, ist das meist der Grund.

Im Vergleich mit preislich nahen Karten

Die drei Karten, die dieser preislich am nächsten liegen. Speicher entscheidet, was lädt; Bandbreite entscheidet, wie schnell die Antwort kommt.

Die L4 im Vergleich mit den drei preislich nächsten Karten
KarteSpeicherBandbreiteInterconnectAb
L4 Diese SeiteAda Lovelace 24 GB 300 GB/s PCIe $125/Monat
RTX 4090Ada Lovelace 24 GB 1,008 GB/s PCIe $193/Monat
RTX A6000Ampere 48 GB 768 GB/s PCIe $286/Monat
RTX 5090Blackwell 32 GB 1,792 GB/s PCIe $335/Monat

Alle 12 Karten im Vergleich, oder lassen Sie den Konfigurator anhand Ihres Modells und Ihrer Kontextlänge auswählen statt anhand eines Preises.

Im Vergleich mit anderen Karten

Die Abwägungen, die man in der Praxis gegenüber an L4 trifft – jede anhand von Preis, Speicher, Bandbreite und den passenden Modellen durchgerechnet.

Was enthalten ist

  • Keine Identitätsprüfung

    Kein Dokument, kein Selfie, keine Telefonnummer, keine Firmenregistrierung.

    Nichts verifiziert · bei jedem Ausgabenbetrag

  • Die ganze Karte

    Die GPU wird an eine Maschine durchgereicht, und diese Maschine gehört Ihnen.

    Kein MIG · kein vGPU · kein Hypervisor

  • Root und IPMI

    Voller Root-Zugriff ab der ersten Minute, plus Fernzugriff auf Stromversorgung und virtuelle Medien.

    Out-of-Band im eigenen VLAN

  • Bandbreite ohne Volumenbegrenzung

    Kein enthaltenes Volumen, keine Mehrverbrauchsstufe, nichts zum Beobachten auf einem Graphen.

    1 bis 25 Gbit/s · in beide Richtungen

  • Keine Einrichtungs- oder Neuinstallationsgebühr

    Installieren Sie so oft neu, wie Sie möchten, mit jedem von uns angebotenen Betriebssystem.

    $0 · Neuinstallationen unbegrenzt

  • Hardware ausgetauscht, schnell

    Mit Ersatzteilen aus derselben Halle, zu jeder Stunde, Festplatten bleiben an ihrem Platz.

    Vier-Stunden-Ziel · 24/7

Wo Sie sie bekommen können

Jede L4-Konfiguration ist in allen 6 Rechenzentren verfügbar. Es gibt keinen Standort, an dem eine Karte mehr kostet, und keinen, an dem sie nicht verfügbar ist.

AMS Verfügbar

Amsterdam

Niederlande

Laufzeit7 ms nach Frankfurt, 12 ms nach London
StandortTier III · 100 % Windkraft
STO Verfügbar

Stockholm

Schweden

Laufzeit22 ms nach Frankfurt, 31 ms nach London
StandortTier III · 100 % Wasserkraft
ZRH Verfügbar

Zürich

Schweiz

Laufzeit9 ms nach Mailand, 15 ms nach Frankfurt
StandortTier IV · 96 % CO2-frei
REY Verfügbar

Reykjavík

Island

Laufzeit18 ms nach London, 40 ms nach New York
StandortTier III · 100 % Geothermie + Wasserkraft
YUL Verfügbar

Montréal

Kanada

Laufzeit12 ms nach New York, 19 ms nach Toronto
StandortTier III · 99 % Wasserkraft
SIN Verfügbar

Singapur

Singapur

Laufzeit38 ms nach Tokio, 45 ms nach Sydney
StandortTier III · Stromnetz + REC-Ausgleich

Fragen zum L4-Server

Wie viel kostet ein L4-Server pro Monat?
Ein L4-Server mit einer Karte kostet $125 im Monat, alles inklusive: 128 GB System-RAM, 2 × 2 TB NVMe, 1 Gbit/s ohne Volumenbegrenzung, eine IPv4-Adresse und ein geroutetes IPv6-/64. Es gibt keine Einrichtungsgebühr und keine Kosten für Bandbreite. Multi-GPU-Knoten reichen von $285 für 2 Karten bis $1,371 für 10.
Wie viel VRAM hat die L4, und was passt hinein?
24 GB GDDR6 pro Karte, bei 300 GB/s. Das größte Modell, das sie bei 8k Kontext auf einer Karte fasst, ist Qwen 3 32B (4-bit (AWQ, GPTQ)).Ein Knoten mit 10 Karten hat insgesamt 240 GB, genug für Llama 3.1 405B.
Ist die L4 dediziert, oder wird sie mit anderen Kunden geteilt?
Dediziert. Die Karte wird direkt an eine einzelne physische Maschine durchgereicht, auf der nur Sie ein Konto haben – kein MIG-Partitioning, keine vGPU-Schicht und kein weiterer Mandant auf demselben Chip. Bei einem Multi-GPU-Knoten erhalten Sie den ganzen Knoten, einschließlich der PCIe 5.0 ×16-Fabric zwischen den Karten.
Muss ich meine Identität verifizieren, um eine L4 zu mieten?
Nein. Es gibt keinen Dokumenten-Upload, kein Selfie, keine Telefonnummer und keine Firmenregistrierung, unabhängig von der Ausgabenhöhe – ein Achtkarten-Knoten wird zu genau denselben Bedingungen eröffnet wie die günstigste Einzelkarte. Für die Kontoeröffnung genügen eine E-Mail-Adresse, ein Passwort und eine Rechnungsadresse, und nichts davon wird geprüft.
Wie bezahle ich, und wie schnell wird der Server geliefert?
Nur in Kryptowährung: Bitcoin, Monero, Ethereum (ERC-20), Tether (ERC-20) und andere. Jede Rechnung erhält eine eigene Adresse, der Betrag wird zum bei Ausstellung angezeigten Kurs fixiert, und die Maschine wird bei der ersten Bestätigung bereitgestellt – Root-Zugriff in under 5 minutes, zu jeder Stunde.
Kann ich eine L4 stattdessen stundenweise mieten?
Hier nicht. Jeder Preis auf dieser Seite ist ein Monatspreis, ohne Zähler und ohne sekundengenaue Abrechnung. Gegenüber einer typischen Cloud zu $2.99/Stunde ist eine monatliche Laufzeit günstiger, sobald die Maschine rund 42 Stunden lang einfach existiert – etwa 2 von dreißig Tagen.

An L4 nur für Sie, ab $125 im Monat.

Im Rack montiert, eingebrannt und einsatzbereit in allen 6 Rechenzentren. Zahlen Sie in Krypto, und er gehört in under 5 minutes Ihnen.

Anmelden

Konsole, Rechnungen und Out-of-Band-Zugriff.

Noch kein Konto?

Es gibt keine separate Registrierung. Ihr Konto wird bei Ihrer ersten Bestellung angelegt — Sie wählen E-Mail und Passwort im Zahlungsschritt, und die Konsole ist offen, sobald die Maschine es ist.

Server konfigurieren

Language