Core switch line-card failure in ZRH, row C
Netzwerk — Transit & Peering — ZRH · Out-of-Band-Management — ZRH
Zeitleiste
-
Behoben
Every machine in row C has been reachable since 07:12 UTC. Duration of the outage: 50 minutes. The failed card is being replaced under an existing maintenance window; the replacement does not require another interruption. Affected machines receive the SLA extension automatically.
-
Beobachtung
All 13 affected ports are up on the surviving card. We are checking each machine individually before closing this.
-
Ursache erkannt
A line card in one of the two core switches in ZRH failed. Row C was dual-homed, but the failover on 13 ports did not complete because the standby links were still training. We are forcing those ports over to the surviving card.
-
Untersuchung läuft
Machines in row C of ZRH lost network connectivity at 06:22 UTC. Rows outside C are unaffected. Engineers are on the floor.
Eine Nachbesprechung des Vorfalls wird hier innerhalb von fünf Tagen nach der Behebung veröffentlicht.
Zeiten werden in Ihrer Zeitzone angezeigt ().
Verwandte Seiten
- ServicestatusLive-Status jeder gpuserver.io-Komponente und jedes Rechenzentrums, alle 60 Sekunden aus fünf Städten gemessen, mit 90-Tage-Verfügbarkeit und Protokoll seit 2022.
- VorfallshistorieJeder Vorfall und jedes Wartungsfenster auf gpuserver.io seit September 2022, mit Zeitleiste und Nachbesprechung des Vorfalls.
- Vereinbarung zum ServicelevelDie 99,9-%-Zusage: was als Ausfallzeit zählt, wie sie von außen gemessen wird, fünf Minuten Laufzeit zurück je verlorener Minute, und die Ausschlüsse vollständig.
- NetzwerkPorts ohne Volumenbegrenzung bis 25 Gbit/s, zwei Carrier und ein IX pro Standort, ständige DDoS-Filterung, geroutetes IPv6 — und vier Dinge, die wir nicht anbieten.