Acuerdo de nivel de servicio.
Un compromiso, medido por máquina, por mes natural. No abonamos saldo en una cuenta porque aquí no existe saldo de cuenta; ampliamos su plazo por el tiempo perdido.
- 99.9%por máquina, por mes natural
- ×5el tiempo perdido, devuelto en forma de plazo
- 0formularios que rellenar para reclamarlo
- 4 hobjetivo para sustituir hardware averiado
1. El compromiso
Disponibilidad del 99,9 % por máquina y por mes natural, sobre la accesibilidad de la red y la alimentación eléctrica.
Eso supone un margen de aproximadamente 43 minutos en un mes de treinta días. A modo de comparación:
| Compromiso | Al mes | Al año | En la práctica |
|---|---|---|---|
| 99% | 7.2 h | 86.4 h | Un día laborable al año fuera de servicio |
| 99.5% | 3.6 h | 43.2 h | Medio día al mes es aceptable |
| 99.9% La nuestra | 43 min | 8.6 h | Un reinicio y un cambio de ruta, y nada más |
| 99.99% | 4 min | 0.9 h | Requiere máquinas redundantes, y un único servidor dedicado no lo es |
Nos comprometemos al 99,9 % y no más, porque una única máquina dedicada no puede prometer honestamente más. Cuatro nueves requieren redundancia entre máquinas, y eso es algo que usted construye sobre lo que nosotros le alquilamos, no algo que podamos venderle en una sola máquina.
2. Qué cuenta como tiempo de inactividad
Un minuto cuenta como tiempo de inactividad cuando su máquina es inaccesible desde fuera de nuestra red, o se ha quedado sin alimentación, por una causa que está bajo nuestro control.
- Red: la dirección pública de su máquina no responde desde fuera de nuestra red, debido a nuestros enrutadores, nuestros switches, nuestros uplinks o nuestro tránsito.
- Alimentación: la máquina se ha quedado sin alimentación eléctrica, o la hemos apagado nosotros.
- Hardware: un componente suministrado por nosotros ha fallado y, por ello, la máquina no puede funcionar. Se cuenta desde que usted lo notifica; véase la cláusula 5.
El tiempo de inactividad se cuenta por máquina. Si usted alquila cuatro servidores y uno de ellos es inaccesible, ese tiene una incidencia; los otros tres no.
3. Cómo se mide
- Desde fuera del centro de datos, sobre la dirección pública, no desde una sonda situada en el mismo rack.
- Con una resolución de un minuto. Una incidencia se cuenta desde la primera comprobación fallida hasta la primera correcta.
- Se necesitan tres comprobaciones fallidas consecutivas para abrir una incidencia, de modo que un único paquete perdido no se convierte en una interrupción. Una vez abierta, cuentan los tres minutos.
- La medición es continua y automática. No requiere que usted se haya dado cuenta.
La página de estado publica lo que registraron las sondas, componente por componente y sede por sede, y conserva cada incidente en su historial — los mismos datos en los que se basa este acuerdo, y el mismo registro desde septiembre de 2022.
4. Qué recibe a cambio
Tiempo, no dinero. Aquí no hay saldo de cuenta que abonar, así que el tiempo de inactividad se compensa en la única moneda realmente equivalente: más tiempo de la máquina que usted alquiló.
5. Sustitución de hardware
Independiente del compromiso de disponibilidad, y merece mencionarse por separado porque es el que usted más probablemente utilizará.
- Objetivo de cuatro horas desde que usted informa la incidencia hasta que el hardware vuelve a funcionar, las 24 horas del día, en cualquier máquina.
- Las piezas de repuesto —tarjetas, fuentes de alimentación, discos y un chasis completo por modelo— se guardan en la misma sala. Sustituirlas es caminar hasta el pasillo, no reservar un mensajero.
- Sus discos permanecen en su sitio en una sustitución de GPU, fuente de alimentación o ventilador. Solo tocamos el almacenamiento cuando el fallo está en el almacenamiento, y antes preguntamos.
- Si no cumplimos con las cuatro horas, el exceso cuenta como tiempo de inactividad conforme a la cláusula 1 y se compensa conforme a la cláusula 4.
Un fallo causado por algo que usted ha hecho —un kernel que no arranca, una regla de firewall que le ha dejado fuera, un fstab que provoca un pánico del sistema— no es un fallo de hardware. Tampoco es un problema que debamos resolver nosotros, porque usted dispone de IPMI y puede solucionarlo usted mismo. Véase la documentación.
6. Trabajos programados
El mantenimiento programado queda excluido del cálculo de disponibilidad, pero solo cuando está realmente programado:
- Al menos 72 horas de aviso previo, a través del contacto que nos indicó.
- Una ventana indicada con una duración máxima indicada.
- Entre las 01:00 y las 05:00, hora local del centro de datos, salvo que un problema de seguridad lo haga imposible.
El trabajo que se prolonga más allá de la ventana indicada cuenta como tiempo de inactividad durante el exceso. El trabajo de emergencia —un fallo en la vía de alimentación, una corrección de seguridad que no puede esperar— se anuncia lo antes posible y sí cuenta como tiempo de inactividad; no vamos a reclasificar nuestra propia emergencia como su mantenimiento programado.
No enviamos actualizaciones de firmware a una máquina durante un plazo. La BIOS, la BMC y la VBIOS se configuran antes de que el nodo entre en el catálogo, y se vuelven a aplicar entre inquilinos; nunca mientras usted la está utilizando.
7. Exclusiones
Lo siguiente no cuenta como tiempo de inactividad. Esta es la lista completa, y si algo no figura en ella, sí cuenta.
- Todo lo que ocurra dentro de su sistema operativo. Un kernel bloqueado, un disco lleno, un servicio mal configurado, una regla de firewall que le ha dejado fuera, un controlador que usted ha sustituido. Usted tiene acceso root; ese lado de la frontera es suyo.
- Mantenimiento programado anunciado conforme a la cláusula 6, dentro de la ventana indicada.
- Suspensión conforme a la política de uso aceptable.
- Falta de pago. Un plazo que ha finalizado no tiene compromiso de disponibilidad.
- Ataques de denegación de servicio dirigidos contra usted, que superen la capacidad de mitigación del sitio. Filtramos en lugar de anular el enrutamiento (null-route) de su dirección, y seguiremos filtrando; no podemos comprometernos a absorber un ataque de tamaño ilimitado.
- Fallos de la internet pública fuera de nuestra red: una interrupción de un peer, un cable submarino, una fuga de rutas de un tercero.
- Fuerza mayor: catástrofe natural, guerra, una orden gubernamental, un fallo del suministro que afecte a toda la instalación más allá de la autonomía de su generador.
- Todo lo que usted nos haya pedido que hagamos, incluidos una reinstalación o un ciclo de apagado y encendido que usted haya solicitado.
8. Impugnar una medición
Si su propia monitorización indica que una máquina estuvo caída y la nuestra no, avísenos. Aporte las marcas de tiempo con su zona horaria y, si dispone de ellos, los resultados en bruto de las comprobaciones.
Revisaremos la misma ventana desde nuestro lado y le diremos lo que vemos. Si nuestra medición fue errónea, la corregimos y aplicamos la cláusula 4: para nosotros, tener razón vale menos que merecer su confianza al respecto.
Una cosa que conviene saber de antemano: una máquina inaccesible desde un punto de internet, pero accesible desde cualquier otro, suele ser un problema de enrutamiento entre su red y la nuestra. Aun así, merece la pena informarlo —a menudo podemos solucionarlo— pero no aparecerá como tiempo de inactividad en una medición realizada desde fuera.
Páginas relacionadas
- Estado del servicioEstado en vivo de gpuserver.io: componentes y centros de datos sondeados cada 60 s desde 5 ciudades, con disponibilidad de 90 días e incidentes desde 2022.
- Historial de incidentesTodos los incidentes y ventanas de mantenimiento de gpuserver.io desde septiembre de 2022, mes a mes, con cronología y revisión posterior al incidente.
- Términos del servicioEl contrato entre usted y gpuserver.io: qué ofrecemos, qué paga, cómo acaba un plazo, reembolsos, suspensión, responsabilidad — escrito para leer, no para hojear.
- RedPuertos sin contador hasta 25 Gbit/s, dos operadores y un IX por sede, filtrado DDoS permanente, IPv6 enrutado — y las cuatro cosas que no ofrecemos, dichas ya.