Kosten-Guide · 6 Min. Lesezeit

# Wann monatliche Miete stundenweise schlägt.

Stundenpreise sind die richtige Antwort für einen Job, der heute fertig wird. Sie werden früher zur falschen Antwort, als die meisten erwarten — und der Break-even ist Arithmetik, keine Meinungssache.

Die kurze Antwort

- **Unser Monatspreis:** $1,469 für NVIDIA H100 PCIe — umgerechnet $2.01 pro Stunde
- **Der Break-even:** Gegenüber einer Cloud zu $2.99/Stunde gewinnt die monatliche Laufzeit ab **492 Stunden** — etwa 20 Tage
- **Die eigentliche Frage:** Nicht „wie viele Stunden werde ich rechnen“, sondern „wie viele Stunden wird die Maschine existieren“
- **Wo stundenweise gewinnt:** Ein Job, der heute fertig wird, oder eine Last, die wirklich stoßweise ist und Eviction verträgt

## Der Break-even

Eine NVIDIA H100 PCIe zu unserem Monatspreis von $1,469, gegen drei Arten, dieselbe Karte stundenweise zu mieten. Der Break-even ist der Punkt, an dem der Zähler Sie so viel gekostet hat wie ein ganzer Monat uns kostet.

**Stunden, bis eine monatliche Laufzeit günstiger ist als stundenweise Abrechnung**

| Stundenoption | Pro Stunde | Ein ganzer Monat | Break-even | Sie sparen bei 24/7 |
|---|---|---|---|---|
| Hyperscaler, nach Bedarf Rabatte für zugesicherte Nutzung setzen ein Jahr und einen Vertrag voraus | $6.98 | $5,095730 Stunden | 211 h 9 Tage | $3,626 jeden Monat |
| Spezialisierte GPU-Cloud Sekundengenaue Abrechnung, keine Verpflichtung | $2.99 | $2,183730 Stunden | 492 h 21 Tage | $714 jeden Monat |
| Marketplace, Community-Stufe Die Maschine eines anderen, unterbrechbar | $1.89 | $1,380730 Stunden | 778 h 32 Tage | Stundenweise ist günstiger |
| Unsere monatliche Laufzeit Dediziert, kein Zähler, keine Eviction | $2.01abgeleitet, nicht abgerechnet | $1,469 | — | — |

Die Stundenpreise sind öffentliche Listenpreise für dieselbe Karte, erhoben in August 2026. Wir rechnen nicht stundenweise ab; der Stundenwert in unserer eigenen Zeile ist der Monatspreis geteilt durch 730, nur zum Vergleich der Spalten angegeben.

## Die Rechnung

Drei Zeilen, und es lohnt sich, sie auszuschreiben, denn bei der zweiten gehen die meisten Schätzungen schief.

Break-even, in Stunden

```
break_even_hours = monthly_price / hourly_price

# For this card, against a $2.99/hour cloud:
$1,469 / $2.99 = 492 hours = 20.5 days

# The mistake: counting only the hours you compute.
# The meter runs while the machine exists, not while it works.
hours_billed = hours_the_instance_is_running   # not hours of useful work
```

Ein Monat hat 730 Stunden. Muss Ihre Maschine mehr als etwa 20 von dreißig Tagen existieren, ist eine monatliche Laufzeit günstiger — und jede Stunde darüber hinaus ist reine Ersparnis.

## Was ein Stundenpreis verbirgt

Der veröffentlichte Preis ist der Teil, den Sie vergleichen können. Diese drei sind der Teil, den Sie nicht vergleichen können, und zusammen zählen sie meist mehr als der Preis selbst.

### Speicher, der separat abgerechnet wird

Auf den meisten stundenweise abrechnenden Plattformen ist die Festplatte ein separater Posten, berechnet pro GB und Monat, und sie wird weiter berechnet, während die Instanz gestoppt ist. Ein 2-TB-Datensatz kann in einem wenig genutzten Monat unauffällig mehr kosten als die GPU.

**Hier:** 2 × 2 TB NVMe ist im Preis enthalten, und nichts wird nach Verbrauch abgerechnet.

### Ausgehender Traffic

Ihre Modellgewichte, Checkpoints oder generierten Ausgaben *herauszubekommen* wird fast überall pro Gigabyte berechnet. Das sind die Kosten, die erst sichtbar werden, wenn die Arbeit gelingt.

**Hier:** 1 Gbit/s, ohne Volumenbegrenzung, in beide Richtungen, kein Mehrverbrauch bei jeglichem Volumen.

### Kaltstart und Eviction

Ein 140-GB-Modell auf eine frische Instanz zu laden, kostet fünfzehn bis vierzig Minuten, für die Sie zahlen und nichts bekommen. Bei unterbrechbaren Stufen zahlen Sie das erneut, jedes Mal, wenn Sie mitten im Lauf per Eviction beendet werden.

**Hier:** Die Maschine gehört Ihnen für die Laufzeit. Gewichte liegen auf ihren Festplatten und bleiben dort.

## Die Leerlaufzeit-Falle

Das ist der Punkt, der aus einer sorgfältigen Schätzung eine dreimal so hohe Rechnung macht. Sekundengenaue Abrechnung fühlt sich sicher an, weil Sie die Instanz stoppen können — und fast niemand tut es, weil das Stoppen bedeutet, den Zustand darauf zu verlieren.

**Monatliche Kosten bei unterschiedlicher tatsächlicher Auslastung, stundenweise im Vergleich zu monatlich**

| Die Maschine läuft | Stunden | Bei $2.99/h | Unser Monatstarif | Günstiger |
|---|---|---|---|---|
| Ein paar Stunden pro Woche | 12 h | $36 | $1,469 | Stundenweise, bei $1,433 |
| Arbeitszeiten, werktags | 176 h | $526 | $1,469 | Stundenweise, bei $943 |
| Jeden Tag, während der Arbeitszeit | 240 h | $718 | $1,469 | Stundenweise, bei $751 |
| Continuously | 730 h | $2,183 | $1,469 | Monatlich, bei $714 |

Lesen Sie die zweite Zeile genau. „Arbeitszeit, werktags“ klingt bescheiden und liegt bereits auf der falschen Seite der Grenze — und setzt voraus, dass Sie die Instanz jeden Abend gewissenhaft stoppen, was wiederum voraussetzt, dass nichts Wichtiges darauf liegt.

**Stellen Sie die ehrliche Frage.** Nicht „wie viele Stunden werde ich die GPU nutzen“, sondern „wie viele Stunden muss diese Maschine existieren“. Ein Endpunkt, der Anfragen beantwortet, ein Modell, an dem Sie gerade arbeiten, ein Datensatz, den Sie nicht erneut herunterladen wollen — all das braucht die Maschine durchgehend, ganz gleich, was die Auslastungsgrafik sagt.

## Längere Laufzeiten

Lautet die Antwort „für ein Jahr“, ist auch der Monatspreis nicht der beste verfügbare. Dieselbe Karte zu unseren drei Laufzeiten:

**Dieselbe Konfiguration bei jeder Laufzeit**

| Laufzeit | Pro Monat | Im Voraus bezahlt | Ersparnis über ein Jahr | Abwägen |
|---|---|---|---|---|
| Monatlich monatliche Abrechnung, jederzeit kündbar | $1,469 | $1,469 | — | Keine. Kündigen Sie vor dem Verlängerungsdatum, dann endet es einfach. |
| 3 Monate 3-Monats-Laufzeit, 5 % Rabatt pro Monat | $1,396 | $4,188 | $876 | Im Voraus bezahlt, nicht anteilig erstattet — dafür gibt es den Rabatt. |
| 12 Monate 12-Monats-Laufzeit, 12 % Rabatt pro Monat | $1,293 | $15,516 | $2,112 | Im Voraus bezahlt, nicht anteilig erstattet — dafür gibt es den Rabatt. |

## Wann stundenweise wirklich richtig ist

Wir verkaufen nicht stundenweise, nehmen Sie das also für das, was es ist: die Fälle, in denen Sie woanders hin sollten.

**Ein Job, der heute fertig wird.** Ein Fine-Tune, ein Benchmark, ein Render. Stundenweise mieten, vier Stunden bezahlen, fertig.

**Wirklich stoßweise Last, die Eviction verträgt.** Wenn Ihre Arbeit sauber Checkpoints setzt und mitten im Lauf beendet werden kann, ist unterbrechbare Kapazität drastisch günstiger als alles Dedizierte.

**Sie brauchen acht Karten für sechs Stunden, einmalig.** Eine monatliche Laufzeit auf einem 8-GPU-Knoten für ein einziges Experiment ist der falsche Zuschnitt.

**Sie wissen es noch nicht.** Mieten Sie stundenweise, bis die Auslastungsgrafik zeigt, was Sie tatsächlich brauchen, und kommen Sie dann mit einer Zahl zurück.

Überall sonst — ein Endpunkt, der antworten muss, ein Modell, mit dem Sie ein Quartal lang leben, eine Karte, die geladen bleiben soll — kostet ein Monat weniger als der Zähler und verhält sich besser. Und anders als ein Rabatt für zugesicherte Nutzung braucht eine monatliche Laufzeit hier keinen Vertrag, keine Firma und keine Identitätsprüfung: Es ist [eine Zahlung](https://gpuserver.io/de/guides/pay-in-crypto), und die Maschine gehört Ihnen.

## Jeder Preis im Katalog ist ein Monatspreis.

Kein Zähler, keine Gebühr für ausgehenden Traffic, kein separater Posten für Speicher, und keine zusätzliche Einrichtungsgebühr.

[Katalog durchsuchen](https://gpuserver.io/de/#catalog) [Guides lesen](https://gpuserver.io/de/guides)

## Weitere Guides

- [Kosten · 9 Min. Self-Hosting gegen eine API mit Preis pro Token Der Break-even zwischen einer API mit Preis pro Token und einer gemieteten GPU, mit unseren eigenen Zahlen — und vier Dinge, die dabei fehlen. Guide lesen](https://gpuserver.io/de/guides/api-vs-self-hosting)
- [Praxis · 11 Min. Llama 3.3 70B auf einem Knoten betreiben Von der gelieferten Maschine zum OpenAI-kompatiblen Endpunkt, mit den Flags, die zählen, und den zweien, die Ihren Durchsatz unbemerkt halbieren. Guide lesen](https://gpuserver.io/de/guides/serve-llama-70b)
- [Praxis · 10 Min. Fine-Tuning eines 70B-Modells auf einer Karte QLoRA auf einer einzelnen 48-GB-GPU: was passt, was ein Monat kostet, und warum vollständiges Fine-Tuning eine andere Größenordnung an Maschine verlangt. Guide lesen](https://gpuserver.io/de/guides/lora-finetune)

---

Quelle: https://gpuserver.io/de/guides/monthly-vs-hourly/. Diese Datei wird aus denselben Daten wie die Website erzeugt; weicht eine Zahl hier von einer Seite ab, ist die Seite maßgeblich und diese Datei veraltet — die kanonische Quelle ist https://gpuserver.io/.
