Ada Lovelace · PCIe-Karte

# Mieten Sie einen dedizierten L40S-GPU-Server.

48 GB GDDR6 ECC bei 864 GB/s, in einer Maschine, die ganz allein Ihnen gehört. Monatlich, bezahlt in Krypto, eröffnet ohne Identitätsprüfung und geliefert in under 5 minutes.

- $714/mo eine Karte, alles inklusive
- 48 GB GDDR6 ECC
- 864 GB/s Speicherbandbreite
- 1×, 2×, 4×, 8× verfügbare Knotengrößen

## Preis, nach Knotengröße und Laufzeit

Eine Zahl pro Zeile, und es ist die gesamte Zahl: keine Einrichtungsgebühr, keine Gebühr für Neuinstallationen, keine Bandbreitenkosten, kein Support-Plan. Längere Laufzeiten werden im Voraus bezahlt.

**Monatspreis eines L40S-Servers, nach Knotengröße und Laufzeit**

| Knoten | CPU und Arbeitsspeicher | Monatlich | 3 Monate | 12 Monate |  |
|---|---|---|---|---|---|
| 1 × L40S 48 GB insgesamt · PCIe 5.0 | Intel Xeon Silver 4410Y12 Kerne / 24 Threads · 128 GB · 2 × 2 TB NVMe | $714/Monat jederzeit kündbar | $678/Monat $108/Jahr sparen | $628/Monat $1,032/Jahr sparen | [Konfigurieren](https://gpuserver.io/de/configure?c=l40s-x1) |
| 2 × L40S 96 GB insgesamt · PCIe 5.0 ×16 | Intel Xeon Gold 5416S16 Kerne / 32 Threads · 256 GB · 2 × 3.84 TB NVMe | $1,427/Monat jederzeit kündbar | $1,356/Monat $213/Jahr sparen | $1,256/Monat $2,052/Jahr sparen | [Konfigurieren](https://gpuserver.io/de/configure?c=l40s-x2) |
| 4 × L40S 192 GB insgesamt · PCIe 5.0 ×16 | 2 × Intel Xeon Gold 6438Y+64 Kerne · 512 GB · 4 × 3.84 TB NVMe | $2,754/Monat jederzeit kündbar | $2,616/Monat $414/Jahr sparen | $2,424/Monat $3,960/Jahr sparen | [Konfigurieren](https://gpuserver.io/de/configure?c=l40s-x4) |
| 8 × L40S 384 GB insgesamt · PCIe 5.0 ×16 | 2 × Intel Xeon Platinum 8462Y+64 Kerne · 1 TB · 8 × 3.84 TB NVMe | $5,251/Monat jederzeit kündbar | $4,988/Monat $789/Jahr sparen | $4,621/Monat $7,560/Jahr sparen | [Konfigurieren](https://gpuserver.io/de/configure?c=l40s-x8) |

Jede Konfiguration oben ist in allen 6 Rechenzentren verfügbar, im Rack montiert und eingebrannt, mit einem startbereiten Image – deshalb dauert die Lieferung under 5 minutes statt eines Arbeitstages.

## Vollständige Spezifikation

GPU NVIDIA L40S Ada Lovelace-Architektur, PCIe-Steckkarte.

Speicher 48 GB GDDR6 ECC 864 GB/s Bandbreite – die Zahl, die die Generierungsgeschwindigkeit weit besser vorhersagt als jede Teraflop-Angabe.

Interconnect PCIe 5.0 ×16 Peer-to-Peer über PCIe. Geeignet für ein Modell pro Karte und für Pipeline-Parallelismus; langsamer als NVLink für Tensor-Parallelismus. [Welche Ihr Job braucht](https://gpuserver.io/de/guides/nvlink-vs-pcie).

Knotengrößen 1 × Karte, 2 × Karte, 4 × Karte, 8 × Karte PCIe-Karten gehen in einem Standardgehäuse bis zu acht, bei Low-Power-Karten bis zu zehn.

Storage 2 × 2 TB NVMe Über das System-Volume hinaus roh übergeben – wir schreiben kein RAID-Level vor. Mehr NVMe und Archiv-HDD sind monatliche Optionen.

Netzwerk 1 Gbit/s, ohne Volumenbegrenzung In beide Richtungen, kein enthaltenes Volumen und kein Mehrverbrauch, unabhängig vom Datenverkehr. Eine IPv4-Adresse, ein geroutetes IPv6-/64, DDoS-Filterung ab Lieferung.

## Was auf an L40S läuft

Jedes Modell unten passt bei 8k Kontext auf *eine einzelne* Karte – kein Sharding, kein Interconnect, um den man sich kümmern müsste. Gezeigt wird die beste Präzision, die passt; die Rechnung steht im [Guide zur VRAM-Dimensionierung](https://gpuserver.io/de/guides/vram-sizing), damit Sie sie nachprüfen können.

**Sprachmodelle, die bei 8k Kontext auf eine einzelne L40S passen**

| Modell | Beste Präzision, die passt | Benötigter Speicher | Geschätzte Token/s |
|---|---|---|---|
| Llama 3.1 8B 8B Parameter | BF16 / FP16Referenzqualität | 20 GBvon 48 GB | ~24 |
| Llama 3.3 70B 70B Parameter | 4-bit (AWQ, GPTQ)Kleinste Gewichte, Cache bleibt FP16 | 43 GBvon 48 GB | ~11 |
| Qwen 3 32B 32B Parameter | FP8Nahe am Referenzdesign, Hopper und Blackwell | 38 GBvon 48 GB | ~12 |
| Mistral Small 24B 24B Parameter | FP8Nahe am Referenzdesign, Hopper und Blackwell | 28 GBvon 48 GB | ~16 |
| Gemma 3 27B 27B Parameter | FP8Nahe am Referenzdesign, Hopper und Blackwell | 33 GBvon 48 GB | ~14 |
| Phi-4 14B 14B Parameter | BF16 / FP16Referenzqualität | 34 GBvon 48 GB | ~14 |

Auf dem 8-Karten-Knoten werden dieselben Modelle über insgesamt 384 GB gehalten, was das Mögliche vollständig verändert – bis zu Llama 3.1 405B. Sharding kostet auf jeder Ebene Synchronisation, daher sollte ein Modell, das auf eine Karte passt, auch auf einer Karte bleiben.

## Zu erwartender Durchsatz

Die Generierung wird durch die Speicherbandbreite begrenzt: Jedes Token erfordert das erneute Einlesen der aktiven Gewichte. Bei 864 GB/s setzt das eine Obergrenze, über die kein Tuning hinauskommt.

**Unsere Zahlen sind eine Untergrenze, kein Versprechen.** Die Schätzungen auf dieser Seite sind an veröffentlichten Messungen kalibriert und bewusst konservativ – sie bilden die Generierung in einem einzelnen Stream ab. Mit kontinuierlichem Batching unter vLLM liegt das *Aggregat* über gleichzeitige Anfragen um ein Vielfaches höher. Wenn eine Zahl hier niedrig gegenüber einem Benchmark wirkt, den Sie gesehen haben, ist das meist der Grund.

## Im Vergleich mit preislich nahen Karten

Die drei Karten, die dieser preislich am nächsten liegen. Speicher entscheidet, was lädt; Bandbreite entscheidet, wie schnell die Antwort kommt.

**Die L40S im Vergleich mit den drei preislich nächsten Karten**

| Karte | Speicher | Bandbreite | Interconnect | Ab |
|---|---|---|---|---|
| L40S Diese Seite Ada Lovelace | 48 GB | 864 GB/s | PCIe | $714/Monat |
| [A100 PCIe](https://gpuserver.io/de/gpu/a100-40gb) Ampere | 40 GB | 1,555 GB/s | PCIe | $392/Monat |
| [A100 PCIe](https://gpuserver.io/de/gpu/a100-80gb) Ampere | 80 GB | 1,935 GB/s | PCIe | $1,091/Monat |
| [RTX 5090](https://gpuserver.io/de/gpu/rtx-5090) Blackwell | 32 GB | 1,792 GB/s | PCIe | $335/Monat |

[Alle 12 Karten im Vergleich](https://gpuserver.io/de/gpu), oder lassen Sie den [Konfigurator](https://gpuserver.io/de/configure) anhand Ihres Modells und Ihrer Kontextlänge auswählen statt anhand eines Preises.

## Im Vergleich mit anderen Karten

Die Abwägungen, die man in der Praxis gegenüber an L40S trifft – jede anhand von Preis, Speicher, Bandbreite und den passenden Modellen durchgerechnet.

- [L40S vs. RTX A6000  Zwei 48-GB-Karten, eine für Rechenzentren gebaut Zum Vergleich](https://gpuserver.io/de/compare/l40s-vs-rtx-a6000)
- [L40S vs. A100 PCIe  HBM gegen GDDR, bei ähnlichem Preis Zum Vergleich](https://gpuserver.io/de/compare/a100-80gb-vs-l40s)

## Was enthalten ist

- ### Keine Identitätsprüfung

  Kein Dokument, kein Selfie, keine Telefonnummer, keine Firmenregistrierung.

  Nichts verifiziert · bei jedem Ausgabenbetrag
- ### Die ganze Karte

  Die GPU wird an eine Maschine durchgereicht, und diese Maschine gehört Ihnen.

  Kein MIG · kein vGPU · kein Hypervisor
- ### Root und IPMI

  Voller Root-Zugriff ab der ersten Minute, plus Fernzugriff auf Stromversorgung und virtuelle Medien.

  Out-of-Band im eigenen VLAN
- ### Bandbreite ohne Volumenbegrenzung

  Kein enthaltenes Volumen, keine Mehrverbrauchsstufe, nichts zum Beobachten auf einem Graphen.

  1 bis 25 Gbit/s · in beide Richtungen
- ### Keine Einrichtungs- oder Neuinstallationsgebühr

  Installieren Sie so oft neu, wie Sie möchten, mit jedem von uns angebotenen Betriebssystem.

  $0 · Neuinstallationen unbegrenzt
- ### Hardware ausgetauscht, schnell

  Mit Ersatzteilen aus derselben Halle, zu jeder Stunde, Festplatten bleiben an ihrem Platz.

  Vier-Stunden-Ziel · 24/7

## Wo Sie sie bekommen können

Jede L40S-Konfiguration ist in allen 6 Rechenzentren verfügbar. Es gibt keinen Standort, an dem eine Karte mehr kostet, und keinen, an dem sie nicht verfügbar ist.

AMS Verfügbar

### Amsterdam

Niederlande

Laufzeit 7 ms nach Frankfurt, 12 ms nach London

Standort Tier III · 100 % Windkraft

STO Verfügbar

### Stockholm

Schweden

Laufzeit 22 ms nach Frankfurt, 31 ms nach London

Standort Tier III · 100 % Wasserkraft

ZRH Verfügbar

### Zürich

Schweiz

Laufzeit 9 ms nach Mailand, 15 ms nach Frankfurt

Standort Tier IV · 96 % CO2-frei

REY Verfügbar

### Reykjavík

Island

Laufzeit 18 ms nach London, 40 ms nach New York

Standort Tier III · 100 % Geothermie + Wasserkraft

YUL Verfügbar

### Montréal

Kanada

Laufzeit 12 ms nach New York, 19 ms nach Toronto

Standort Tier III · 99 % Wasserkraft

SIN Verfügbar

### Singapur

Singapur

Laufzeit 38 ms nach Tokio, 45 ms nach Sydney

Standort Tier III · Stromnetz + REC-Ausgleich

## Fragen zum L40S-Server

Wie viel kostet ein L40S-Server pro Monat?

Ein L40S-Server mit einer Karte kostet $714 im Monat, alles inklusive: 128 GB System-RAM, 2 × 2 TB NVMe, 1 Gbit/s ohne Volumenbegrenzung, eine IPv4-Adresse und ein geroutetes IPv6-/64. Es gibt keine Einrichtungsgebühr und keine Kosten für Bandbreite. Multi-GPU-Knoten reichen von $1,427 für 2 Karten bis $5,251 für 8.

Wie viel VRAM hat die L40S, und was passt hinein?

48 GB GDDR6 ECC pro Karte, bei 864 GB/s. Das größte Modell, das sie bei 8k Kontext auf einer Karte fasst, ist Llama 3.3 70B (4-bit (AWQ, GPTQ)).Ein Knoten mit 8 Karten hat insgesamt 384 GB, genug für Llama 3.1 405B.

Ist die L40S dediziert, oder wird sie mit anderen Kunden geteilt?

Dediziert. Die Karte wird direkt an eine einzelne physische Maschine durchgereicht, auf der nur Sie ein Konto haben – kein MIG-Partitioning, keine vGPU-Schicht und kein weiterer Mandant auf demselben Chip. Bei einem Multi-GPU-Knoten erhalten Sie den ganzen Knoten, einschließlich der PCIe 5.0 ×16-Fabric zwischen den Karten.

Muss ich meine Identität verifizieren, um eine L40S zu mieten?

Nein. Es gibt keinen Dokumenten-Upload, kein Selfie, keine Telefonnummer und keine Firmenregistrierung, unabhängig von der Ausgabenhöhe – ein Achtkarten-Knoten wird zu genau denselben Bedingungen eröffnet wie die günstigste Einzelkarte. Für die Kontoeröffnung genügen eine E-Mail-Adresse, ein Passwort und eine Rechnungsadresse, und nichts davon wird geprüft.

Wie bezahle ich, und wie schnell wird der Server geliefert?

Nur in Kryptowährung: Bitcoin, Monero, Ethereum (ERC-20), Tether (ERC-20) und andere. Jede Rechnung erhält eine eigene Adresse, der Betrag wird zum bei Ausstellung angezeigten Kurs fixiert, und die Maschine wird bei der ersten Bestätigung bereitgestellt – Root-Zugriff in under 5 minutes, zu jeder Stunde.

Kann ich eine L40S stattdessen stundenweise mieten?

Hier nicht. Jeder Preis auf dieser Seite ist ein Monatspreis, ohne Zähler und ohne sekundengenaue Abrechnung. Gegenüber einer typischen Cloud zu $2.99/Stunde ist eine monatliche Laufzeit günstiger, sobald die Maschine rund 239 Stunden lang einfach existiert – etwa 10 von dreißig Tagen.

## An L40S nur für Sie, ab $714 im Monat.

Im Rack montiert, eingebrannt und einsatzbereit in allen 6 Rechenzentren. Zahlen Sie in Krypto, und er gehört in under 5 minutes Ihnen.

[Diesen Server konfigurieren](https://gpuserver.io/de/configure?c=l40s-x1) [Guides lesen](https://gpuserver.io/de/guides)

## Verwandte Seiten

- [Hardware-Richtlinie Unsere zwölf NVIDIA-GPUs, der 72-Stunden-Burn-in vor dem Verkauf eines Knotens, das Vier-Stunden-Ziel für den Austausch, und die Plattenlöschung zwischen Mandanten.](https://gpuserver.io/de/hardware)
- [Guides Acht praktische Guides: VRAM-Größe, NVLink vs. PCIe, Bild- und Videomodelle, monatlich vs. stündlich, Self-Hosting vs. API, Llama 70B servieren, QLoRA.](https://gpuserver.io/de/guides)
- [Dokumentation Erstes SSH, Hardware-Prüfung, CUDA-Container, ein Modell mit vLLM servieren, RAID, Firewalling, IPMI und Neuinstallation – die Befehle, auf einer echten Maschine.](https://gpuserver.io/de/docs)
- [Netzwerk Ports ohne Volumenbegrenzung bis 25 Gbit/s, zwei Carrier und ein IX pro Standort, ständige DDoS-Filterung, geroutetes IPv6 — und vier Dinge, die wir nicht anbieten.](https://gpuserver.io/de/network)

---

Quelle: https://gpuserver.io/de/gpu/l40s/. Diese Datei wird aus denselben Daten wie die Website erzeugt; weicht eine Zahl hier von einer Seite ab, ist die Seite maßgeblich und diese Datei veraltet — die kanonische Quelle ist https://gpuserver.io/.
