Ada Lovelace · PCIe-Karte

# Mieten Sie einen dedizierten L4-GPU-Server.

24 GB GDDR6 bei 300 GB/s, in einer Maschine, die ganz allein Ihnen gehört. Monatlich, bezahlt in Krypto, eröffnet ohne Identitätsprüfung und geliefert in under 5 minutes.

- $125/mo eine Karte, alles inklusive
- 24 GB GDDR6
- 300 GB/s Speicherbandbreite
- 1×, 2×, 4×, 8×, 10× verfügbare Knotengrößen

## Preis, nach Knotengröße und Laufzeit

Eine Zahl pro Zeile, und es ist die gesamte Zahl: keine Einrichtungsgebühr, keine Gebühr für Neuinstallationen, keine Bandbreitenkosten, kein Support-Plan. Längere Laufzeiten werden im Voraus bezahlt.

**Monatspreis eines L4-Servers, nach Knotengröße und Laufzeit**

| Knoten | CPU und Arbeitsspeicher | Monatlich | 3 Monate | 12 Monate |  |
|---|---|---|---|---|---|
| 1 × L4 24 GB insgesamt · PCIe 5.0 | Intel Xeon Silver 4410Y12 Kerne / 24 Threads · 128 GB · 2 × 2 TB NVMe | $125/Monat jederzeit kündbar | $119/Monat $18/Jahr sparen | $110/Monat $180/Jahr sparen | [Konfigurieren](https://gpuserver.io/de/configure?c=l4-x1) |
| 2 × L4 48 GB insgesamt · PCIe 5.0 ×16 | Intel Xeon Gold 5416S16 Kerne / 32 Threads · 256 GB · 2 × 3.84 TB NVMe | $285/Monat jederzeit kündbar | $271/Monat $42/Jahr sparen | $251/Monat $408/Jahr sparen | [Konfigurieren](https://gpuserver.io/de/configure?c=l4-x2) |
| 4 × L4 96 GB insgesamt · PCIe 5.0 ×16 | 2 × Intel Xeon Gold 6438Y+64 Kerne · 512 GB · 4 × 3.84 TB NVMe | $564/Monat jederzeit kündbar | $536/Monat $84/Jahr sparen | $496/Monat $816/Jahr sparen | [Konfigurieren](https://gpuserver.io/de/configure?c=l4-x4) |
| 8 × L4 192 GB insgesamt · PCIe 5.0 ×16 | 2 × Intel Xeon Platinum 8462Y+64 Kerne · 1 TB · 8 × 3.84 TB NVMe | $1,106/Monat jederzeit kündbar | $1,051/Monat $165/Jahr sparen | $973/Monat $1,596/Jahr sparen | [Konfigurieren](https://gpuserver.io/de/configure?c=l4-x8) |
| 10 × L4 240 GB insgesamt · PCIe 5.0 ×16 | 2 × Intel Xeon Platinum 8462Y+64 Kerne · 1 TB · 8 × 7.68 TB NVMe | $1,371/Monat jederzeit kündbar | $1,302/Monat $207/Jahr sparen | $1,206/Monat $1,980/Jahr sparen | [Konfigurieren](https://gpuserver.io/de/configure?c=l4-x10) |

Jede Konfiguration oben ist in allen 6 Rechenzentren verfügbar, im Rack montiert und eingebrannt, mit einem startbereiten Image – deshalb dauert die Lieferung under 5 minutes statt eines Arbeitstages.

## Vollständige Spezifikation

GPU NVIDIA L4 Ada Lovelace-Architektur, PCIe-Steckkarte.

Speicher 24 GB GDDR6 300 GB/s Bandbreite – die Zahl, die die Generierungsgeschwindigkeit weit besser vorhersagt als jede Teraflop-Angabe.

Interconnect PCIe 5.0 ×16 Peer-to-Peer über PCIe. Geeignet für ein Modell pro Karte und für Pipeline-Parallelismus; langsamer als NVLink für Tensor-Parallelismus. [Welche Ihr Job braucht](https://gpuserver.io/de/guides/nvlink-vs-pcie).

Knotengrößen 1 × Karte, 2 × Karte, 4 × Karte, 8 × Karte, 10 × Karte PCIe-Karten gehen in einem Standardgehäuse bis zu acht, bei Low-Power-Karten bis zu zehn.

Storage 2 × 2 TB NVMe Über das System-Volume hinaus roh übergeben – wir schreiben kein RAID-Level vor. Mehr NVMe und Archiv-HDD sind monatliche Optionen.

Netzwerk 1 Gbit/s, ohne Volumenbegrenzung In beide Richtungen, kein enthaltenes Volumen und kein Mehrverbrauch, unabhängig vom Datenverkehr. Eine IPv4-Adresse, ein geroutetes IPv6-/64, DDoS-Filterung ab Lieferung.

## Was auf an L4 läuft

Jedes Modell unten passt bei 8k Kontext auf *eine einzelne* Karte – kein Sharding, kein Interconnect, um den man sich kümmern müsste. Gezeigt wird die beste Präzision, die passt; die Rechnung steht im [Guide zur VRAM-Dimensionierung](https://gpuserver.io/de/guides/vram-sizing), damit Sie sie nachprüfen können.

**Sprachmodelle, die bei 8k Kontext auf eine einzelne L4 passen**

| Modell | Beste Präzision, die passt | Benötigter Speicher | Geschätzte Token/s |
|---|---|---|---|
| Llama 3.1 8B 8B Parameter | BF16 / FP16Referenzqualität | 20 GBvon 24 GB | ~8 |
| Qwen 3 32B 32B Parameter | 4-bit (AWQ, GPTQ)Kleinste Gewichte, Cache bleibt FP16 | 21 GBvon 24 GB | ~8 |
| Mistral Small 24B 24B Parameter | 4-bit (AWQ, GPTQ)Kleinste Gewichte, Cache bleibt FP16 | 15 GBvon 24 GB | ~11 |
| Gemma 3 27B 27B Parameter | 4-bit (AWQ, GPTQ)Kleinste Gewichte, Cache bleibt FP16 | 20 GBvon 24 GB | ~10 |
| Phi-4 14B 14B Parameter | FP8Nahe am Referenzdesign, Hopper und Blackwell | 17 GBvon 24 GB | ~10 |

Auf dem 10-Karten-Knoten werden dieselben Modelle über insgesamt 240 GB gehalten, was das Mögliche vollständig verändert – bis zu Llama 3.1 405B. Sharding kostet auf jeder Ebene Synchronisation, daher sollte ein Modell, das auf eine Karte passt, auch auf einer Karte bleiben.

## Zu erwartender Durchsatz

Die Generierung wird durch die Speicherbandbreite begrenzt: Jedes Token erfordert das erneute Einlesen der aktiven Gewichte. Bei 300 GB/s setzt das eine Obergrenze, über die kein Tuning hinauskommt.

**Unsere Zahlen sind eine Untergrenze, kein Versprechen.** Die Schätzungen auf dieser Seite sind an veröffentlichten Messungen kalibriert und bewusst konservativ – sie bilden die Generierung in einem einzelnen Stream ab. Mit kontinuierlichem Batching unter vLLM liegt das *Aggregat* über gleichzeitige Anfragen um ein Vielfaches höher. Wenn eine Zahl hier niedrig gegenüber einem Benchmark wirkt, den Sie gesehen haben, ist das meist der Grund.

## Im Vergleich mit preislich nahen Karten

Die drei Karten, die dieser preislich am nächsten liegen. Speicher entscheidet, was lädt; Bandbreite entscheidet, wie schnell die Antwort kommt.

**Die L4 im Vergleich mit den drei preislich nächsten Karten**

| Karte | Speicher | Bandbreite | Interconnect | Ab |
|---|---|---|---|---|
| L4 Diese Seite Ada Lovelace | 24 GB | 300 GB/s | PCIe | $125/Monat |
| [RTX 4090](https://gpuserver.io/de/gpu/rtx-4090) Ada Lovelace | 24 GB | 1,008 GB/s | PCIe | $193/Monat |
| [RTX A6000](https://gpuserver.io/de/gpu/rtx-a6000) Ampere | 48 GB | 768 GB/s | PCIe | $286/Monat |
| [RTX 5090](https://gpuserver.io/de/gpu/rtx-5090) Blackwell | 32 GB | 1,792 GB/s | PCIe | $335/Monat |

[Alle 12 Karten im Vergleich](https://gpuserver.io/de/gpu), oder lassen Sie den [Konfigurator](https://gpuserver.io/de/configure) anhand Ihres Modells und Ihrer Kontextlänge auswählen statt anhand eines Preises.

## Im Vergleich mit anderen Karten

Die Abwägungen, die man in der Praxis gegenüber an L4 trifft – jede anhand von Preis, Speicher, Bandbreite und den passenden Modellen durchgerechnet.

- [L4 vs. RTX 4090  Rohe Geschwindigkeit gegen niedrigen Verbrauch Zum Vergleich](https://gpuserver.io/de/compare/rtx-4090-vs-nvidia-l4)

## Was enthalten ist

- ### Keine Identitätsprüfung

  Kein Dokument, kein Selfie, keine Telefonnummer, keine Firmenregistrierung.

  Nichts verifiziert · bei jedem Ausgabenbetrag
- ### Die ganze Karte

  Die GPU wird an eine Maschine durchgereicht, und diese Maschine gehört Ihnen.

  Kein MIG · kein vGPU · kein Hypervisor
- ### Root und IPMI

  Voller Root-Zugriff ab der ersten Minute, plus Fernzugriff auf Stromversorgung und virtuelle Medien.

  Out-of-Band im eigenen VLAN
- ### Bandbreite ohne Volumenbegrenzung

  Kein enthaltenes Volumen, keine Mehrverbrauchsstufe, nichts zum Beobachten auf einem Graphen.

  1 bis 25 Gbit/s · in beide Richtungen
- ### Keine Einrichtungs- oder Neuinstallationsgebühr

  Installieren Sie so oft neu, wie Sie möchten, mit jedem von uns angebotenen Betriebssystem.

  $0 · Neuinstallationen unbegrenzt
- ### Hardware ausgetauscht, schnell

  Mit Ersatzteilen aus derselben Halle, zu jeder Stunde, Festplatten bleiben an ihrem Platz.

  Vier-Stunden-Ziel · 24/7

## Wo Sie sie bekommen können

Jede L4-Konfiguration ist in allen 6 Rechenzentren verfügbar. Es gibt keinen Standort, an dem eine Karte mehr kostet, und keinen, an dem sie nicht verfügbar ist.

AMS Verfügbar

### Amsterdam

Niederlande

Laufzeit 7 ms nach Frankfurt, 12 ms nach London

Standort Tier III · 100 % Windkraft

STO Verfügbar

### Stockholm

Schweden

Laufzeit 22 ms nach Frankfurt, 31 ms nach London

Standort Tier III · 100 % Wasserkraft

ZRH Verfügbar

### Zürich

Schweiz

Laufzeit 9 ms nach Mailand, 15 ms nach Frankfurt

Standort Tier IV · 96 % CO2-frei

REY Verfügbar

### Reykjavík

Island

Laufzeit 18 ms nach London, 40 ms nach New York

Standort Tier III · 100 % Geothermie + Wasserkraft

YUL Verfügbar

### Montréal

Kanada

Laufzeit 12 ms nach New York, 19 ms nach Toronto

Standort Tier III · 99 % Wasserkraft

SIN Verfügbar

### Singapur

Singapur

Laufzeit 38 ms nach Tokio, 45 ms nach Sydney

Standort Tier III · Stromnetz + REC-Ausgleich

## Fragen zum L4-Server

Wie viel kostet ein L4-Server pro Monat?

Ein L4-Server mit einer Karte kostet $125 im Monat, alles inklusive: 128 GB System-RAM, 2 × 2 TB NVMe, 1 Gbit/s ohne Volumenbegrenzung, eine IPv4-Adresse und ein geroutetes IPv6-/64. Es gibt keine Einrichtungsgebühr und keine Kosten für Bandbreite. Multi-GPU-Knoten reichen von $285 für 2 Karten bis $1,371 für 10.

Wie viel VRAM hat die L4, und was passt hinein?

24 GB GDDR6 pro Karte, bei 300 GB/s. Das größte Modell, das sie bei 8k Kontext auf einer Karte fasst, ist Qwen 3 32B (4-bit (AWQ, GPTQ)).Ein Knoten mit 10 Karten hat insgesamt 240 GB, genug für Llama 3.1 405B.

Ist die L4 dediziert, oder wird sie mit anderen Kunden geteilt?

Dediziert. Die Karte wird direkt an eine einzelne physische Maschine durchgereicht, auf der nur Sie ein Konto haben – kein MIG-Partitioning, keine vGPU-Schicht und kein weiterer Mandant auf demselben Chip. Bei einem Multi-GPU-Knoten erhalten Sie den ganzen Knoten, einschließlich der PCIe 5.0 ×16-Fabric zwischen den Karten.

Muss ich meine Identität verifizieren, um eine L4 zu mieten?

Nein. Es gibt keinen Dokumenten-Upload, kein Selfie, keine Telefonnummer und keine Firmenregistrierung, unabhängig von der Ausgabenhöhe – ein Achtkarten-Knoten wird zu genau denselben Bedingungen eröffnet wie die günstigste Einzelkarte. Für die Kontoeröffnung genügen eine E-Mail-Adresse, ein Passwort und eine Rechnungsadresse, und nichts davon wird geprüft.

Wie bezahle ich, und wie schnell wird der Server geliefert?

Nur in Kryptowährung: Bitcoin, Monero, Ethereum (ERC-20), Tether (ERC-20) und andere. Jede Rechnung erhält eine eigene Adresse, der Betrag wird zum bei Ausstellung angezeigten Kurs fixiert, und die Maschine wird bei der ersten Bestätigung bereitgestellt – Root-Zugriff in under 5 minutes, zu jeder Stunde.

Kann ich eine L4 stattdessen stundenweise mieten?

Hier nicht. Jeder Preis auf dieser Seite ist ein Monatspreis, ohne Zähler und ohne sekundengenaue Abrechnung. Gegenüber einer typischen Cloud zu $2.99/Stunde ist eine monatliche Laufzeit günstiger, sobald die Maschine rund 42 Stunden lang einfach existiert – etwa 2 von dreißig Tagen.

## An L4 nur für Sie, ab $125 im Monat.

Im Rack montiert, eingebrannt und einsatzbereit in allen 6 Rechenzentren. Zahlen Sie in Krypto, und er gehört in under 5 minutes Ihnen.

[Diesen Server konfigurieren](https://gpuserver.io/de/configure?c=l4-x1) [Guides lesen](https://gpuserver.io/de/guides)

## Verwandte Seiten

- [Hardware-Richtlinie Unsere zwölf NVIDIA-GPUs, der 72-Stunden-Burn-in vor dem Verkauf eines Knotens, das Vier-Stunden-Ziel für den Austausch, und die Plattenlöschung zwischen Mandanten.](https://gpuserver.io/de/hardware)
- [Guides Acht praktische Guides: VRAM-Größe, NVLink vs. PCIe, Bild- und Videomodelle, monatlich vs. stündlich, Self-Hosting vs. API, Llama 70B servieren, QLoRA.](https://gpuserver.io/de/guides)
- [Dokumentation Erstes SSH, Hardware-Prüfung, CUDA-Container, ein Modell mit vLLM servieren, RAID, Firewalling, IPMI und Neuinstallation – die Befehle, auf einer echten Maschine.](https://gpuserver.io/de/docs)
- [Netzwerk Ports ohne Volumenbegrenzung bis 25 Gbit/s, zwei Carrier und ein IX pro Standort, ständige DDoS-Filterung, geroutetes IPv6 — und vier Dinge, die wir nicht anbieten.](https://gpuserver.io/de/network)

---

Quelle: https://gpuserver.io/de/gpu/nvidia-l4/. Diese Datei wird aus denselben Daten wie die Website erzeugt; weicht eine Zahl hier von einer Seite ab, ist die Seite maßgeblich und diese Datei veraltet — die kanonische Quelle ist https://gpuserver.io/.
