成本 指南 · 阅读需 6 分钟

# 月付何时胜过按小时计费。

对于今天就能完成的任务，按小时计价是正确答案。但它变成错误答案的速度，比大多数人预期的要快——而收支平衡点是算出来的，不是靠感觉判断的。

简短的答案

- **我们的月付价格:** NVIDIA H100 PCIe 的价格是 $1,469 — 折算下来每小时 $2.01
- **收支平衡点:** 与按 $2.99/小时计费的云相比，超过 **492 小时**后月付就更划算 — 约合 20 天
- **真正的问题:** 问题不是“我要计算多少小时”，而是“这台机器要存在多少小时”
- **按小时计费胜出的地方:** 今天就能完成的任务，或者真正突发、能够容忍被驱逐的负载

## 收支平衡点

一张 NVIDIA H100 PCIe，我们的月付价格是 $1,469，对比三种按小时租用同款显卡的方式。收支平衡点，就是按量计费的花费追上我们整月价格的那一刻。

**月付比按小时计费更划算所需的小时数**

| 按小时选项 | 按小时 | 整整一个月 | Break-even | 24/7 全天候使用时，您就能省钱 |
|---|---|---|---|---|
| 超大规模云厂商，按需 承诺使用折扣需要签一年合同 | $6.98 | $5,095730 小时 | 211 h 9 天 | $3,626 每月 |
| 专业 GPU 云 按秒计费，无需承诺 | $2.99 | $2,183730 小时 | 492 h 21 天 | $714 每月 |
| 市场平台，社区档 别人的机器，可抢占 | $1.89 | $1,380730 小时 | 778 h 32 天 | 按小时更便宜 |
| 我们的月付套餐 独享，不按量计费，不会被驱逐 | $2.01推算得出，并非实际计费 | $1,469 | — | — |

按小时计价的数字，是同款显卡在 August 2026 观察到的公开挂牌价。我们并不按小时计费；我们这一行的每小时数字，是月付价格除以 730 得出的，仅用于方便与其他列比较。

## 运算

三行内容，值得写清楚，因为大多数预估在第二行就出了错。

收支平衡点（小时）

```
break_even_hours = monthly_price / hourly_price

# For this card, against a $2.99/hour cloud:
$1,469 / $2.99 = 492 hours = 20.5 days

# The mistake: counting only the hours you compute.
# The meter runs while the machine exists, not while it works.
hours_billed = hours_the_instance_is_running   # not hours of useful work
```

一个月是 730 小时。如果您的机器在三十天里需要存在超过约 20 天，月付套餐就更划算——超过这个点之后的每一小时都是纯粹的节省。

## 按小时价格背后隐藏着什么

公开的价格是您能比较的部分。而这三项是您无法比较的部分，它们加在一起，往往比价格本身更重要。

### 单独计费的存储

在大多数按小时计费的平台上，磁盘是单独计费的一项，按每 GB 每月收费，即使实例已经停止运行也照样计费。在使用率较低的月份，一个 2 TB 的数据集悄悄花掉的钱，可能比 GPU 本身还多。

**而在这里：**2 × 2 TB NVMe 已包含在价格中，一切都不按量计费。

### 出站流量

把模型权重、检查点或生成结果*取出*，几乎在所有地方都要按 GB 计费。这是一项只有在任务成功之后才会出现的费用。

**而在这里：**1 Gbit/s，不限流量，双向皆然，无论用量多大都没有超额费用。

### 冷启动与被驱逐

把一个 140 GB 的模型拉取到全新实例上，需要十五到四十分钟——这段时间您照样付费，却什么都得不到。在可抢占档位上，每次运行途中被驱逐，您都要再付一次这笔钱。

**而在这里：**整台机器在租期内都归您使用。权重存放在它的磁盘上，并一直留在那里。

## 闲置时间的陷阱

正是这一项，能把一份谨慎的预估变成三倍大的账单。按秒计费让人感觉安全，因为您随时可以停止实例——但几乎没有人真的这么做，因为一旦停止，实例上的状态就没了。

**不同实际利用率下的月度费用：按小时计费与月付对比**

| 机器持续运行 | 小时 | $2.99/小时 | 我们的月付价格 | 更便宜 |
|---|---|---|---|---|
| 每周几个小时 | 12 h | $36 | $1,469 | 按小时，便宜 $1,433 |
| 工作日的上班时间 | 176 h | $526 | $1,469 | 按小时，便宜 $943 |
| 每天，仅工作时间 | 240 h | $718 | $1,469 | 按小时，便宜 $751 |
| Continuously | 730 h | $2,183 | $1,469 | 按月，便宜 $714 |

仔细看第二行。“工作日的上班时间”听起来并不多，但已经站在了不划算的一侧——而且这还假设您每天晚上都会认真地停掉实例，这就要求实例上不能留有任何您在意的东西。

**问一个诚实的问题** 不是“我要用 GPU 多少小时”，而是“这台机器需要存在多少小时”。一个要持续响应请求的服务端点、一个您正在迭代的模型、一份您不想重新下载的数据集——这些都需要机器持续存在，无论利用率图表怎么显示。

## 更长的租期

如果答案是“整整一年”，那么月付价格也不是能拿到的最优价格。同一张显卡在我们三种租期下的价格：

**同一配置在各种租期下的价格**

| 租期 | 每月 | 预付 | 一年下来节省的金额 | 权衡 |
|---|---|---|---|---|
| 月付 按月计费，随时可取消 | $1,469 | $1,469 | — | 没有。只要在续期日期之前取消，服务就会直接停止。 |
| 3 个月 3 个月租期，每月立减 5% | $1,396 | $4,188 | $876 | 预付款项，不按比例退还。这正是折扣的代价。 |
| 12 个月 12 个月租期，每月立减 12% | $1,293 | $15,516 | $2,112 | 预付款项，不按比例退还。这正是折扣的代价。 |

## 什么时候按小时计费才真正划算

我们不出售按小时计费的服务，所以请把这部分内容看作它本来的样子：这些情况下，您应该去别处租用。

**今天就能完成的任务。**一次微调，一次基准测试，一次渲染。按小时租用，付四小时的钱，做完就走。

**真正的突发负载，能够容忍被驱逐。**如果您的任务能够干净地保存检查点、并且可以在运行途中被中断，那么可抢占算力比任何独享资源都便宜得多。

**您只需要八张显卡，用六个小时，仅此一次。**为了跑一次实验就购买一台八卡节点的月付套餐，是选错了购买方式。

**您还不确定。**先按小时租用，等利用率图表告诉您真正需要多少，再带着具体数字回来。

在其他所有情况下——需要持续响应的服务端点、您要用上一个季度的模型、您想让显卡一直保持加载状态——按月计费都比按量计费更便宜，表现也更好。而且与承诺使用折扣不同，这里的月付套餐不需要合同、不需要公司主体、也不需要身份核验：只需[一次付款](https://gpuserver.io/zh/guides/pay-in-crypto)，机器就是您的了。

## 产品目录中的每个价格都是月付价格。

不按量计费，没有出站流量费用，没有存储单独收费，也没有额外的开通费。

[浏览产品目录](https://gpuserver.io/zh/#catalog) [阅读指南](https://gpuserver.io/zh/guides)

## 其他指南

- [成本 · 9 分钟 自托管对比按 token 计费的 API 按 token 计费的 API 与租用 GPU 之间的盈亏平衡点，基于我们自己的价格与吞吐量计算得出——以及这套算法遗漏的四件事。 阅读指南](https://gpuserver.io/zh/guides/api-vs-self-hosting)
- [实践 · 11 分钟 在单个节点上部署 Llama 3.3 70B 从交付完成的服务器，到一个兼容 OpenAI 的推理端点：这中间有真正重要的启动参数，也有会悄悄把吞吐量拦腰砍半的那两个参数。 阅读指南](https://gpuserver.io/zh/guides/serve-llama-70b)
- [实践 · 10 分钟 在单张显卡上微调 70B 模型 在单张 48 GB 显卡上使用 QLoRA 微调：能放下什么样的模型、每月需要多少成本，以及为何完整微调需要完全不同量级的服务器。 阅读指南](https://gpuserver.io/zh/guides/lora-finetune)

---

来源：https://gpuserver.io/zh/guides/monthly-vs-hourly/。本文件由与网站相同的数据生成；如果此处的数字与页面不一致，以页面为准，本文件视为过期——权威来源是 https://gpuserver.io/。
