Alle 6 Rechenzentren betriebsbereit

Bezahlung in Krypto · Keine Identitätsprüfung · Root-Zugriff in unter 5 Minuten

Blackwell · PCIe-Karte

Mieten Sie einen dedizierten RTX 5090-GPU-Server.

32 GB GDDR7 bei 1,792 GB/s, in einer Maschine, die ganz allein Ihnen gehört. Monatlich, bezahlt in Krypto, eröffnet ohne Identitätsprüfung und geliefert in under 5 minutes.

  • $335/moeine Karte, alles inklusive
  • 32 GBGDDR7
  • 1,792 GB/sSpeicherbandbreite
  • 1×, 2×, 4×, 8×verfügbare Knotengrößen

Preis, nach Knotengröße und Laufzeit

Eine Zahl pro Zeile, und es ist die gesamte Zahl: keine Einrichtungsgebühr, keine Gebühr für Neuinstallationen, keine Bandbreitenkosten, kein Support-Plan. Längere Laufzeiten werden im Voraus bezahlt.

Monatspreis eines RTX 5090-Servers, nach Knotengröße und Laufzeit
Knoten CPU und Arbeitsspeicher Monatlich 3 Monate 12 Monate
1 × RTX 5090 32 GB insgesamt · PCIe 5.0 AMD Ryzen 9 7950X16 Kerne / 32 Threads · 128 GB · 2 × 2 TB NVMe $335/Monat jederzeit kündbar $318/Monat $51/Jahr sparen $295/Monat $480/Jahr sparen Konfigurieren
2 × RTX 5090 64 GB insgesamt · PCIe 5.0 ×16 AMD Threadripper 7960X24 Kerne / 48 Threads · 256 GB · 2 × 3.84 TB NVMe $692/Monat jederzeit kündbar $657/Monat $105/Jahr sparen $609/Monat $996/Jahr sparen Konfigurieren
4 × RTX 5090 128 GB insgesamt · PCIe 5.0 ×16 AMD Threadripper 7970X32 Kerne / 64 Threads · 512 GB · 4 × 3.84 TB NVMe $1,345/Monat jederzeit kündbar $1,278/Monat $201/Jahr sparen $1,184/Monat $1,932/Jahr sparen Konfigurieren
8 × RTX 5090 256 GB insgesamt · PCIe 5.0 ×16 2 × Intel Xeon Gold 6438Y+64 Kerne · 1 TB · 8 × 3.84 TB NVMe $2,584/Monat jederzeit kündbar $2,455/Monat $387/Jahr sparen $2,274/Monat $3,720/Jahr sparen Konfigurieren

Jede Konfiguration oben ist in allen 6 Rechenzentren verfügbar, im Rack montiert und eingebrannt, mit einem startbereiten Image – deshalb dauert die Lieferung under 5 minutes statt eines Arbeitstages.

Vollständige Spezifikation

GPUNVIDIA RTX 5090Blackwell-Architektur, PCIe-Steckkarte.
Speicher32 GB GDDR71,792 GB/s Bandbreite – die Zahl, die die Generierungsgeschwindigkeit weit besser vorhersagt als jede Teraflop-Angabe.
InterconnectPCIe 5.0 ×16Peer-to-Peer über PCIe. Geeignet für ein Modell pro Karte und für Pipeline-Parallelismus; langsamer als NVLink für Tensor-Parallelismus. Welche Ihr Job braucht.
Knotengrößen1 × Karte, 2 × Karte, 4 × Karte, 8 × KartePCIe-Karten gehen in einem Standardgehäuse bis zu acht, bei Low-Power-Karten bis zu zehn.
Storage2 × 2 TB NVMeÜber das System-Volume hinaus roh übergeben – wir schreiben kein RAID-Level vor. Mehr NVMe und Archiv-HDD sind monatliche Optionen.
Netzwerk1 Gbit/s, ohne VolumenbegrenzungIn beide Richtungen, kein enthaltenes Volumen und kein Mehrverbrauch, unabhängig vom Datenverkehr. Eine IPv4-Adresse, ein geroutetes IPv6-/64, DDoS-Filterung ab Lieferung.

Was auf an RTX 5090 läuft

Jedes Modell unten passt bei 8k Kontext auf eine einzelne Karte – kein Sharding, kein Interconnect, um den man sich kümmern müsste. Gezeigt wird die beste Präzision, die passt; die Rechnung steht im Guide zur VRAM-Dimensionierung, damit Sie sie nachprüfen können.

Sprachmodelle, die bei 8k Kontext auf eine einzelne RTX 5090 passen
ModellBeste Präzision, die passtBenötigter SpeicherGeschätzte Token/s
Llama 3.1 8B8B Parameter BF16 / FP16Referenzqualität 20 GBvon 32 GB ~50
Qwen 3 32B32B Parameter 4-bit (AWQ, GPTQ)Kleinste Gewichte, Cache bleibt FP16 21 GBvon 32 GB ~50
Mistral Small 24B24B Parameter FP8Nahe am Referenzdesign, Hopper und Blackwell 28 GBvon 32 GB ~34
Gemma 3 27B27B Parameter 4-bit (AWQ, GPTQ)Kleinste Gewichte, Cache bleibt FP16 20 GBvon 32 GB ~60
Phi-4 14B14B Parameter FP8Nahe am Referenzdesign, Hopper und Blackwell 17 GBvon 32 GB ~58

Auf dem 8-Karten-Knoten werden dieselben Modelle über insgesamt 256 GB gehalten, was das Mögliche vollständig verändert – bis zu Llama 3.1 405B. Sharding kostet auf jeder Ebene Synchronisation, daher sollte ein Modell, das auf eine Karte passt, auch auf einer Karte bleiben.

Zu erwartender Durchsatz

Die Generierung wird durch die Speicherbandbreite begrenzt: Jedes Token erfordert das erneute Einlesen der aktiven Gewichte. Bei 1,792 GB/s setzt das eine Obergrenze, über die kein Tuning hinauskommt.

Unsere Zahlen sind eine Untergrenze, kein Versprechen. Die Schätzungen auf dieser Seite sind an veröffentlichten Messungen kalibriert und bewusst konservativ – sie bilden die Generierung in einem einzelnen Stream ab. Mit kontinuierlichem Batching unter vLLM liegt das Aggregat über gleichzeitige Anfragen um ein Vielfaches höher. Wenn eine Zahl hier niedrig gegenüber einem Benchmark wirkt, den Sie gesehen haben, ist das meist der Grund.

Im Vergleich mit preislich nahen Karten

Die drei Karten, die dieser preislich am nächsten liegen. Speicher entscheidet, was lädt; Bandbreite entscheidet, wie schnell die Antwort kommt.

Die RTX 5090 im Vergleich mit den drei preislich nächsten Karten
KarteSpeicherBandbreiteInterconnectAb
RTX 5090 Diese SeiteBlackwell 32 GB 1,792 GB/s PCIe $335/Monat
RTX A6000Ampere 48 GB 768 GB/s PCIe $286/Monat
A100 PCIeAmpere 40 GB 1,555 GB/s PCIe $392/Monat
RTX 4090Ada Lovelace 24 GB 1,008 GB/s PCIe $193/Monat

Alle 12 Karten im Vergleich, oder lassen Sie den Konfigurator anhand Ihres Modells und Ihrer Kontextlänge auswählen statt anhand eines Preises.

Im Vergleich mit anderen Karten

Die Abwägungen, die man in der Praxis gegenüber an RTX 5090 trifft – jede anhand von Preis, Speicher, Bandbreite und den passenden Modellen durchgerechnet.

Was enthalten ist

  • Keine Identitätsprüfung

    Kein Dokument, kein Selfie, keine Telefonnummer, keine Firmenregistrierung.

    Nichts verifiziert · bei jedem Ausgabenbetrag

  • Die ganze Karte

    Die GPU wird an eine Maschine durchgereicht, und diese Maschine gehört Ihnen.

    Kein MIG · kein vGPU · kein Hypervisor

  • Root und IPMI

    Voller Root-Zugriff ab der ersten Minute, plus Fernzugriff auf Stromversorgung und virtuelle Medien.

    Out-of-Band im eigenen VLAN

  • Bandbreite ohne Volumenbegrenzung

    Kein enthaltenes Volumen, keine Mehrverbrauchsstufe, nichts zum Beobachten auf einem Graphen.

    1 bis 25 Gbit/s · in beide Richtungen

  • Keine Einrichtungs- oder Neuinstallationsgebühr

    Installieren Sie so oft neu, wie Sie möchten, mit jedem von uns angebotenen Betriebssystem.

    $0 · Neuinstallationen unbegrenzt

  • Hardware ausgetauscht, schnell

    Mit Ersatzteilen aus derselben Halle, zu jeder Stunde, Festplatten bleiben an ihrem Platz.

    Vier-Stunden-Ziel · 24/7

Wo Sie sie bekommen können

Jede RTX 5090-Konfiguration ist in allen 6 Rechenzentren verfügbar. Es gibt keinen Standort, an dem eine Karte mehr kostet, und keinen, an dem sie nicht verfügbar ist.

AMS Verfügbar

Amsterdam

Niederlande

Laufzeit7 ms nach Frankfurt, 12 ms nach London
StandortTier III · 100 % Windkraft
STO Verfügbar

Stockholm

Schweden

Laufzeit22 ms nach Frankfurt, 31 ms nach London
StandortTier III · 100 % Wasserkraft
ZRH Verfügbar

Zürich

Schweiz

Laufzeit9 ms nach Mailand, 15 ms nach Frankfurt
StandortTier IV · 96 % CO2-frei
REY Verfügbar

Reykjavík

Island

Laufzeit18 ms nach London, 40 ms nach New York
StandortTier III · 100 % Geothermie + Wasserkraft
YUL Verfügbar

Montréal

Kanada

Laufzeit12 ms nach New York, 19 ms nach Toronto
StandortTier III · 99 % Wasserkraft
SIN Verfügbar

Singapur

Singapur

Laufzeit38 ms nach Tokio, 45 ms nach Sydney
StandortTier III · Stromnetz + REC-Ausgleich

Fragen zum RTX 5090-Server

Wie viel kostet ein RTX 5090-Server pro Monat?
Ein RTX 5090-Server mit einer Karte kostet $335 im Monat, alles inklusive: 128 GB System-RAM, 2 × 2 TB NVMe, 1 Gbit/s ohne Volumenbegrenzung, eine IPv4-Adresse und ein geroutetes IPv6-/64. Es gibt keine Einrichtungsgebühr und keine Kosten für Bandbreite. Multi-GPU-Knoten reichen von $692 für 2 Karten bis $2,584 für 8.
Wie viel VRAM hat die RTX 5090, und was passt hinein?
32 GB GDDR7 pro Karte, bei 1,792 GB/s. Das größte Modell, das sie bei 8k Kontext auf einer Karte fasst, ist Qwen 3 32B (4-bit (AWQ, GPTQ)).Ein Knoten mit 8 Karten hat insgesamt 256 GB, genug für Llama 3.1 405B.
Ist die RTX 5090 dediziert, oder wird sie mit anderen Kunden geteilt?
Dediziert. Die Karte wird direkt an eine einzelne physische Maschine durchgereicht, auf der nur Sie ein Konto haben – kein MIG-Partitioning, keine vGPU-Schicht und kein weiterer Mandant auf demselben Chip. Bei einem Multi-GPU-Knoten erhalten Sie den ganzen Knoten, einschließlich der PCIe 5.0 ×16-Fabric zwischen den Karten.
Muss ich meine Identität verifizieren, um eine RTX 5090 zu mieten?
Nein. Es gibt keinen Dokumenten-Upload, kein Selfie, keine Telefonnummer und keine Firmenregistrierung, unabhängig von der Ausgabenhöhe – ein Achtkarten-Knoten wird zu genau denselben Bedingungen eröffnet wie die günstigste Einzelkarte. Für die Kontoeröffnung genügen eine E-Mail-Adresse, ein Passwort und eine Rechnungsadresse, und nichts davon wird geprüft.
Wie bezahle ich, und wie schnell wird der Server geliefert?
Nur in Kryptowährung: Bitcoin, Monero, Ethereum (ERC-20), Tether (ERC-20) und andere. Jede Rechnung erhält eine eigene Adresse, der Betrag wird zum bei Ausstellung angezeigten Kurs fixiert, und die Maschine wird bei der ersten Bestätigung bereitgestellt – Root-Zugriff in under 5 minutes, zu jeder Stunde.
Kann ich eine RTX 5090 stattdessen stundenweise mieten?
Hier nicht. Jeder Preis auf dieser Seite ist ein Monatspreis, ohne Zähler und ohne sekundengenaue Abrechnung. Gegenüber einer typischen Cloud zu $2.99/Stunde ist eine monatliche Laufzeit günstiger, sobald die Maschine rund 113 Stunden lang einfach existiert – etwa 5 von dreißig Tagen.

An RTX 5090 nur für Sie, ab $335 im Monat.

Im Rack montiert, eingebrannt und einsatzbereit in allen 6 Rechenzentren. Zahlen Sie in Krypto, und er gehört in under 5 minutes Ihnen.

Anmelden

Konsole, Rechnungen und Out-of-Band-Zugriff.

Noch kein Konto?

Es gibt keine separate Registrierung. Ihr Konto wird bei Ihrer ersten Bestellung angelegt — Sie wählen E-Mail und Passwort im Zahlungsschritt, und die Konsole ist offen, sobald die Maschine es ist.

Server konfigurieren

Language