Uns gehören die Maschinen, die wir Ihnen vermieten.
gpuserver.io ist ein kleiner, unabhängiger Betreiber. Wir kaufen die Karten, bauen sie in gemieteten Hallen ins Rack ein und vermieten sie im Monat. Nichts hier ist aus der Cloud eines anderen weiterverkauft — nur deshalb können wir versprechen, dass die Spezifikation in einer Zeile die Spezifikation ist, die Sie bekommen.
- 6Rechenzentren, alles gemietete Hallen
- 12GPU-Modelle, jedes davon neu gekauft
- 41Konfigurationen, alle verfügbar
- 0aus einer anderen Cloud weiterverkaufte Karten
Eine GPU zu mieten war zur kompliziertesten Art geworden, Rechenleistung zu kaufen.
Wir haben damit angefangen, weil wir zuerst selbst Kunden waren, und weil jede Option vor uns auf dieselben drei Arten falsch war.
Die Hyperscaler verlangten eine Firmenregistrierung, eine Bonitätsprüfung und einen Kontingentantrag, bevor sie uns überhaupt in die Nähe eines A100 ließen — und rechneten dann sekundengenau ab für eine Maschine, die wir ein Jahr lang behalten wollten. Die Marktplätze waren günstiger, aber die Karte war jemandes übrig gebliebener Desktop-PC hinter einer Privatleitung, und der Knoten verschwand mitten im Lauf. Die spezialisierten Clouds waren ehrlich und gut, und so bepreist, als wäre eine GPU ein knappes Metall.
Keiner von ihnen würde uns einfach eine Maschine für einen Monat vermieten, die Zahlung entgegennehmen und Root übergeben. Also haben wir die Hardware gekauft und genau das getan.
Was wir entschieden haben, in dieser Reihenfolge
Und in dieser Reihenfolge, weil jede den nächsten einschränkt
Die Karten zu besitzen, ist es, was die anderen drei möglich macht. Ein Reseller kann keine Spezifikation versprechen, die er nicht kontrolliert, und kann eine KYC-Anforderung nicht ablehnen, die von seinem eigenen Lieferanten auferlegt wird.
Vier Dinge, die wir nicht beugen, auch wenn es uns etwas kostet.
Jeder einzelne Punkt hier hat uns bereits einen Verkauf gekostet. Sie stehen auf dieser Seite, damit Sie uns daran messen können.
Nie eine Identität
Nicht bei der Anmeldung, nicht bei der Verlängerung und nicht, wenn die Summe groß wird. Es gibt keine Verifizierungsstufe: Ein Acht-GPU-Knoten wird zu genau denselben Bedingungen freigeschaltet wie die günstigste einzelne Karte.
- Kein Ausweisdokument, kein Selfie, keine Telefonnummer
- Nichts, was Sie eingeben, wird gegen irgendetwas abgeglichen
- Keine Schwelle, die eine Prüfung auslöst
Der Preis ist der Preis
Eine Zahl pro Konfiguration pro Laufzeit. Keine Einrichtungsgebühr, keine Neuinstallationsgebühr, kein Bandbreiten-Mehrverbrauch, kein Supportplan und kein Rabatt, der nur erscheint, wenn man danach fragt.
- Nach der Rechnung wird nichts mehr gemessen
- Derselbe Preis, ganz gleich, wer Sie sind
- Eine Monatslaufzeit ohne Vertragsstrafe kündigen
Das Angebot ist die Maschine
Wenn wir die exakte Karte aus der Zeile nicht liefern können, sagen wir es Ihnen und erstatten die Laufzeit. Wir liefern kein annähernd gleichwertiges Modell in der Hoffnung, dass der Unterschied unbemerkt bleibt.
- Ein Mandant pro physischer Karte
- Kein MIG, kein vGPU, kein Hypervisor
- Seriennummern pro Gehäuse erfasst
Wir halten so wenig wie möglich
Wir behalten, was der Dienst erzeugt, und sonst nichts, denn Daten, die wir nicht haben, sind Daten, zu deren Herausgabe uns niemand zwingen kann. Festplatten werden zwischen Mandanten gelöscht, ohne dass wir darum gebeten werden.
- Kein Login innerhalb Ihres Betriebssystems
- Kein Backup Ihrer Festplatten
- Nichts wird über seine angegebene Lebensdauer hinaus aufbewahrt
Eine Halle nach der anderen.
Wir haben nie Kapital aufgenommen und nie Kapazität gekauft, die wir nicht füllen konnten. Jeder Standort unten wurde aus dem Umsatz des vorherigen eröffnet, was langsamer ist als die Alternative — und der Grund, warum es uns noch gibt.
2021 · AMS
Amsterdam, Niederlande
Tier III, 100 % Windkraft. Die erste Halle, und immer noch die größte. Alles, was wir über Burn-in-Tests gelernt haben, haben wir hier gelernt, meist, indem wir es falsch gemacht haben.
2022 · STO
Stockholm, Schweden
Tier III, 100 % Wasserkraft. Nach demselben Muster eröffnet wie die anderen: zwei Carrier, ein öffentlicher Exchange, Ersatzteile vor Ort, und keine Maschine verkauft, bevor sie drei Tage Last überstanden hat.
2023 · ZRH
Zürich, Schweiz
Tier IV, 96 % CO2-frei. Nach demselben Muster eröffnet wie die anderen: zwei Carrier, ein öffentlicher Exchange, Ersatzteile vor Ort, und keine Maschine verkauft, bevor sie drei Tage Last überstanden hat.
2023 · YUL
Montréal, Kanada
Tier III, 99 % Wasserkraft. Nach demselben Muster eröffnet wie die anderen: zwei Carrier, ein öffentlicher Exchange, Ersatzteile vor Ort, und keine Maschine verkauft, bevor sie drei Tage Last überstanden hat.
2024 · REY
Reykjavík, Island
Tier III, 100 % Geothermie + Wasserkraft. Nach demselben Muster eröffnet wie die anderen: zwei Carrier, ein öffentlicher Exchange, Ersatzteile vor Ort, und keine Maschine verkauft, bevor sie drei Tage Last überstanden hat.
2025 · SIN
Singapur, Singapur
Tier III, Stromnetz + REC-Ausgleich. Nach demselben Muster eröffnet wie die anderen: zwei Carrier, ein öffentlicher Exchange, Ersatzteile vor Ort, und keine Maschine verkauft, bevor sie drei Tage Last überstanden hat.
Was wir nicht sind.
Die halbe Wahl eines Anbieters besteht darin, schnell auszuschließen. Hier ist alles, was uns ausschließen sollte.
Keine Cloud. Es gibt keine Konsole, kein Autoscaling, keine verwaltete Datenbank und keinen Object Store. Sie bekommen eine Maschine und Root darauf.
Kein Marktplatz. Hier listet niemand seinen übrig gebliebenen Desktop-PC. Jede Karte gehört uns, in einem Rechenzentrum, an einer gemieteten Standleitung.
Nicht stündlich. Wenn Sie eine Karte für zwei Stunden pro Woche brauchen, sind wir die teure Option, und Sie sollten einen Anbieter mit Abrechnung pro Sekunde nutzen.
Kein Trainingscluster. NVLink verbindet die Karten innerhalb eines Knotens. Wir verkaufen keine Anbindung zwischen Knoten, daher ist ein Workload, der 32 GPUs in einem Lauf braucht, nichts für uns.
Kein Anonymitätsdienst. Keine Identitätsprüfung ist nicht dasselbe wie keine Spur. Ihre Maschine hat eine öffentliche Adresse, und Ihr Traffic geht dorthin, wohin Sie ihn senden.
Nicht rechtsfrei. Wir fragen nicht, wer Sie sind, was es umso wichtiger macht, dass wir danach handeln, was eine Maschine tut. Die Richtlinie zur zulässigen Nutzung ist kurz, und sie wird durchgesetzt.
Wer antwortet, ist auch die Person mit der Ersatzkarte.
Es gibt hier keinen First-Level-Support und keine Ticket-Stufen, weil wir dafür nicht genug Leute sind. Eine Nachricht über eine drosselnde GPU erreicht jemanden, der zum Rack gehen kann.
Das hat seinen Preis, und wir sagen ihn lieber offen, als ihn zu beschönigen: Wir sind klein. Wir besetzen keine Telefonleitung, wir bieten keinen namentlich benannten Kundenbetreuer, und wenn Sie einen Beschaffungsprozess mit unterzeichnetem Rahmenvertrag brauchen, sind wir dafür nicht eingerichtet.
Was wir bieten, ist, dass die Antwort, die Sie bekommen, von jemandem kommt, der die Maschine kennt, und dass sie meist innerhalb einer Stunde eintrifft.
Engineering, nicht Support
Jeder, der eine Nachricht beantwortet, baut auch Hardware ins Rack ein. Deshalb ist eine Antwort zur NVLink-Topologie konkret und kein Link zu einer Wissensdatenbank.
Rund um die Uhr, ehrlich gesagt
Hardwareausfälle werden zu jeder Stunde behoben, mit einem Vier-Stunden-Ziel. Nicht dringende Fragen werden während der Wachstunden in Europa beantwortet, und das sagen wir lieber offen, als es zu verschleiern.
Schriftlich, auf Englisch
Ein Kanal, ein Thread, kein Telefon-Pingpong. Alles, was wir Ihnen über Ihre Maschine mitteilen, wird schriftlich festgehalten, wo Sie es nachlesen können.
Die Maschinen sind bereits im Rack montiert.
Jede Konfiguration im Katalog ist angeschlossen, eingebrannt und wartet in allen 6 Hallen. Nichts wird auf Abruf gebaut, weshalb Root in unter 5 Minuten verfügbar ist.
Verwandte Seiten
- Hardware-RichtlinieUnsere zwölf NVIDIA-GPUs, der 72-Stunden-Burn-in vor dem Verkauf eines Knotens, das Vier-Stunden-Ziel für den Austausch, und die Plattenlöschung zwischen Mandanten.
- NetzwerkPorts ohne Volumenbegrenzung bis 25 Gbit/s, zwei Carrier und ein IX pro Standort, ständige DDoS-Filterung, geroutetes IPv6 — und vier Dinge, die wir nicht anbieten.
- Zulässige NutzungWas auf einer gpuserver.io-Maschine erlaubt ist und was nicht, was Sie vorher klären sollten, und das Verfahren beim Grenzübertritt.
- GuidesAcht praktische Guides: VRAM-Größe, NVLink vs. PCIe, Bild- und Videomodelle, monatlich vs. stündlich, Self-Hosting vs. API, Llama 70B servieren, QLoRA.