服务等级协议。
一项承诺,按每台机器、每个自然月计量。我们不会为账户充值,因为这里没有账户余额;我们会按您损失的时间延长您的租期。
- 99.9%每台服务器、每个自然月
- ×5以租期形式返还所损失的时间
- 0需要填写的申领表格
- 4 h更换故障硬件的目标时限
1. 承诺
每台服务器、每个自然月 99.9% 的可用性,涵盖网络可达性与电力供应。
以 30 天的月份计算,这大约相当于43 分钟的预算。作为对比:
| 承诺 | 每月 | 每年 | 实践中 |
|---|---|---|---|
| 99% | 7.2 h | 86.4 h | 每年停机一个工作日 |
| 99.5% | 3.6 h | 43.2 h | 每月停机半天,可接受 |
| 99.9% 我们的监测数据 | 43 min | 8.6 h | 最多一次重启加一次改路由,仅此而已 |
| 99.99% | 4 min | 0.9 h | 需要冗余服务器,而单台独享服务器并不具备这一点 |
我们承诺的是 99.9%,不会更高,因为单台独享服务器无法诚实地承诺更高的可用性。四个9需要跨服务器的冗余,这是您需要在我们所租用的基础上自行构建的,而不是我们能在一台服务器上出售给您的东西。
2. 什么算作停机
当您的服务器因我们可控的原因而无法从我们网络之外访问,或发生断电时,该分钟即计为停机时间。
- 网络:由于我们的路由器、交换机、上联链路或转接线路的原因,您服务器的公网地址从我们网络之外无法响应。
- 电力:服务器断电,或由我们主动关闭电源。
- 硬件:我们提供的部件发生故障,导致服务器无法运行。计时从您报告问题开始,另见第 5 条。
停机时间按服务器单独计算。如果您租用了四台服务器,其中一台无法访问,则该台服务器计入事件,其余三台不受影响。
3. 如何计算
- 从数据中心外部、通过公网地址进行监测,而非来自同一机柜内的探测点。
- 以一分钟为最小计量单位。事件计时从首次检测失败开始,到首次检测成功为止。
- 需要连续三次检测失败才会判定为一起事件,因此单次丢包不会被记为一次故障。一旦事件成立,这三分钟都计入停机时间。
- 监测是持续且自动进行的,不需要您先行察觉。
状态页会逐个组件、逐个站点发布探测记录,并将每一次事故都保留在历史记录中——本协议正是依据这份数据判定,也是自 2022 年 9 月以来的同一份记录。
4. 您将获得的补偿
补偿时间,而非金钱。这里没有可充值的账户余额,因此停机时间以唯一真正等价的方式偿还:延长您所租用服务器的使用时间。
5. 硬件更换
这与可用性承诺是分开的,之所以单独说明,是因为它是您最有可能用到的一项。
- 四小时目标,从您报告问题到硬件恢复正常运行,全天候适用于任何服务器。
- 备件——显卡、电源、硬盘,以及每种型号一台整机——均存放在同一机房套间内。更换备件只需走到过道另一头,而不必预约快递。
- 更换显卡、电源或风扇时,您的硬盘保持原位不动。只有在存储本身出现故障时,我们才会触碰存储,而且会事先征得您的同意。
- 如果我们未能在四小时内完成,超出部分将依据第 1 条计入停机时间,并依据第 4 条予以补偿。
由您自身操作导致的故障——无法启动的内核、把您锁在外面的防火墙规则、导致服务器内核崩溃(panic)的 fstab——不属于硬件故障。这也不是我们负责修复的问题,因为您拥有 IPMI,可以自行修复。参见文档。
6. 计划性维护
计划性维护不计入可用性计算,但前提是它必须是真正经过公告安排的:
- 至少提前 72 小时通知,通过您提供给我们的联系方式。
- 一个明确公告的时间窗口,并有明确规定的最长时长。
- 数据中心当地时间 01:00 至 05:00 之间,除非安全问题导致无法做到。
超出公告时间窗口的维护工作,其超出部分计入停机时间。紧急维护——例如电力线路故障、刻不容缓的安全修复——我们会尽早公告,但这类维护仍计入停机时间;我们不会把自己的紧急情况重新归类为您的计划性维护。
我们不会在租期内向服务器推送固件更新。BIOS、BMC 和 VBIOS 均在节点进入产品目录前设置完成,并在租户更替之间重新应用,绝不会在您使用期间进行。
7. 例外情况
以下情况不计入停机时间。这是完整的清单,凡未列入其中的情况,均计入停机时间。
- 操作系统内部的一切。内核崩溃、磁盘写满、服务配置错误、将您锁在外面的防火墙规则、您自行更换的驱动程序。您拥有 root 权限,边界的这一侧属于您。
- 按第 6 条公告的计划性维护,且在其公告的时间窗口内进行。
- 依据可接受使用政策实施的暂停。
- 未付款。已到期的租期不享有可用性承诺。
- 针对您的拒绝服务攻击,超出本站点的缓解能力。我们会对您的地址进行流量过滤而非空路由丢弃,并将持续过滤;但我们无法承诺吸收无限规模的攻击。
- 我们网络之外的公共互联网故障——对等网络中断、海底电缆故障、他方路由泄漏等。
- 不可抗力:自然灾害、战争、政府命令,或超出发电机续航能力、影响整座设施的公共设施故障。
- 您要求我们执行的任何操作,包括您请求的重新安装或电源重启。
8. 对计算结果提出异议
如果您自己的监测显示服务器曾经宕机,而我们的监测没有记录到,请告知我们。请提供带时区的时间戳,如有原始检测结果,也请一并提供。
我们会从我们这一侧查看同一时间窗口,并告知您我们看到的结果。如果我们的测量有误,我们会予以更正,并依据第 4 条进行补偿——对我们而言,赢得您的信任,比证明自己正确更重要。
有一点值得您提前了解:如果服务器仅从互联网上的某一处无法访问,而从其他所有地方均可访问,这通常是您的网络与我们网络之间的路由问题。这种情况仍然值得报告——我们往往可以解决——但它不会在从外部进行的测量中显示为停机时间。
相关页面
- 服务状态gpuserver.io 每一个组件与数据中心的实时状态,由 5 座城市每 60 秒探测一次,含 90 天可用性与自 2022 年起的事故记录。
- 事故历史gpuserver.io 自 2022 年 9 月开始监测以来发生的每一次事故与每一个维护窗口,均按月整理存档,并附完整时间线与事故复盘。
- 服务条款您与 gpuserver.io 之间的合同:我们提供什么、您支付什么、租期如何结束、退款、暂停服务、责任范围——写来是为了被认真阅读,而非草草浏览。
- 网络每个站点提供最高 25 Gbit/s 不限流量端口、两家运营商与一个 IX、全天候 DDoS 过滤、可路由 IPv6——以及我们明确不提供的四件事。