Ada Lovelace · PCIe 显卡

# 租用一台独享 RTX 4090 GPU 服务器。

24 GB GDDR6X，带宽 1,008 GB/s，机器完全归您独享。按月计费，加密货币支付，开通无需身份核验，under 5 minutes 内交付。

- $193/mo 单卡，一切均已包含
- 24 GB GDDR6X
- 1,008 GB/s 显存带宽
- 1×, 2×, 4×, 8× 可选节点规格

## 价格，按节点规格与租期

每一行只有一个数字，而且是全部费用：没有开通费，没有重装费，没有带宽费，没有支持套餐费。更长租期需一次性预付。

**RTX 4090 服务器的月费，按节点规格与租期长度列出**

| 节点 | CPU 与内存 | 月付 | 3 个月 | 12 个月 |  |
|---|---|---|---|---|---|
| 1 × RTX 4090 共 24 GB · PCIe 5.0 | AMD Ryzen 9 7950X16 c / 32 t · 128 GB · 2 × 2 TB NVMe | $193/月 随时可取消 | $183/月 每年节省 $30 | $170/月 每年节省 $276 | [配置](https://gpuserver.io/zh/configure?c=rtx4090-x1) |
| 2 × RTX 4090 共 48 GB · PCIe 5.0 ×16 | AMD Threadripper 7960X24 c / 48 t · 256 GB · 2 × 3.84 TB NVMe | $416/月 随时可取消 | $395/月 每年节省 $63 | $366/月 每年节省 $600 | [配置](https://gpuserver.io/zh/configure?c=rtx4090-x2) |
| 4 × RTX 4090 共 96 GB · PCIe 5.0 ×16 | AMD Threadripper 7970X32 c / 64 t · 512 GB · 4 × 3.84 TB NVMe | $814/月 随时可取消 | $773/月 每年节省 $123 | $716/月 每年节省 $1,176 | [配置](https://gpuserver.io/zh/configure?c=rtx4090-x4) |
| 8 × RTX 4090 共 192 GB · PCIe 5.0 ×16 | 2 × Intel Xeon Gold 6438Y+64 c · 1 TB · 8 × 3.84 TB NVMe | $1,579/月 随时可取消 | $1,500/月 每年节省 $237 | $1,390/月 每年节省 $2,268 | [配置](https://gpuserver.io/zh/configure?c=rtx4090-x8) |

以上每种配置在全部 6个数据中心均有现货，已上架并完成烤机，镜像随时可写入——这正是交付时间是 under 5 minutes 而非一个工作日的原因。

## 完整规格

GPU NVIDIA RTX 4090 Ada Lovelace 架构，PCIe 插卡。

显存 24 GB GDDR6X 1,008 GB/s 带宽——预测生成速度的数字，远比任何 teraflop 数值准确。

互联 PCIe 5.0 ×16 通过 PCIe 点对点通信。适合一卡一模型和流水线并行；用于张量并行时比 NVLink 慢。 [您的任务需要哪一款](https://gpuserver.io/zh/guides/nvlink-vs-pcie).

节点规格 1 × 显卡, 2 × 显卡, 4 × 显卡, 8 × 显卡 PCIe 显卡在标准机箱中最多可装 8 张，仅低功耗显卡可达 10 张。

存储 2 × 2 TB NVMe 系统卷之外的存储以裸盘形式交付——我们不强制任何 RAID 级别。更多 NVMe 和归档 HDD 可按月加购。

网络 1 Gbit/s，不限流量 双向流量，不含流量额度，任何流量水平下都没有超额费用。1个 IPv4 地址，一段可路由的 IPv6 /64，交付时即开启 DDoS 过滤。

## an RTX 4090 能运行什么

下方每个模型都能在 8k 上下文下放进*单张*显卡——无需拆分，也无需考虑互联。所示精度是能放下的最高精度；具体算法见[显存容量计算指南](https://gpuserver.io/zh/guides/vram-sizing)，供您核对。

**在 8k 上下文下能放进单张 RTX 4090 的语言模型**

| 模型 | 能放下的最高精度 | 所需显存 | 预计 token/秒 |
|---|---|---|---|
| Llama 3.1 8B 8B 参数 | BF16 / FP16公版品质 | 20 GB24 GB 的 | ~28 |
| Qwen 3 32B 32B 参数 | 4-bit (AWQ, GPTQ)权重最小，缓存保持 FP16 | 21 GB24 GB 的 | ~28 |
| Mistral Small 24B 24B 参数 | 4-bit (AWQ, GPTQ)权重最小，缓存保持 FP16 | 15 GB24 GB 的 | ~38 |
| Gemma 3 27B 27B 参数 | 4-bit (AWQ, GPTQ)权重最小，缓存保持 FP16 | 20 GB24 GB 的 | ~34 |
| Phi-4 14B 14B 参数 | FP8接近公版，Hopper 与 Blackwell | 17 GB24 GB 的 | ~32 |

在 8卡节点上，同样的模型分布在总共 192 GB 显存中，这彻底改变了可行的范围 ——最大可达 Qwen 3 235B-A22B (MoE)。拆分会在每一层都带来同步开销，所以能放进一张显卡的模型就应该留在一张显卡上。

## 预期吞吐量

生成速度受限于显存带宽：每个 token 都需要重新读取激活的权重。在 1,008 GB/s 下，这就是一个无论如何调优都无法突破的上限。

**我们给出的数字是下限，而非承诺。** 本页的估算值是根据已公开的测试数据校准的，并且刻意保守——它们衡量的是单流生成。在 vLLM 的连续批处理下，多个并发请求的*总吞吐量*会高出数倍。如果这里的数字比您见过的基准测试低，通常就是这个原因。

## 与相近显卡对比

与这张显卡价格最接近的三款显卡。显存决定能加载什么，带宽决定响应速度。

**RTX 4090 与价格最接近的三款显卡对比**

| 显卡 | 显存 | 带宽 | 互联 | 起 |
|---|---|---|---|---|
| RTX 4090 本页 Ada Lovelace | 24 GB | 1,008 GB/s | PCIe | $193/月 |
| [L4](https://gpuserver.io/zh/gpu/nvidia-l4) Ada Lovelace | 24 GB | 300 GB/s | PCIe | $125/月 |
| [RTX A6000](https://gpuserver.io/zh/gpu/rtx-a6000) Ampere | 48 GB | 768 GB/s | PCIe | $286/月 |
| [RTX 5090](https://gpuserver.io/zh/gpu/rtx-5090) Blackwell | 32 GB | 1,792 GB/s | PCIe | $335/月 |

[并排查看全部 12 款显卡](https://gpuserver.io/zh/gpu)，或者让[配置器](https://gpuserver.io/zh/configure)根据您的模型和上下文长度来选择，而不是根据价格。

## 与其他显卡对比

面对 an RTX 4090，人们实际做出的权衡取舍，均基于价格、显存、带宽和可容纳的模型逐一得出。

- [RTX 4090 对比 RTX 5090  消费级旗舰，相差一代 查看对比](https://gpuserver.io/zh/compare/rtx-5090-vs-rtx-4090)
- [RTX 4090 对比 L4  原始速度与低功耗 查看对比](https://gpuserver.io/zh/compare/rtx-4090-vs-nvidia-l4)
- [RTX 4090 对比 A100 PCIe  便宜快速的显卡对比数据中心显卡 查看对比](https://gpuserver.io/zh/compare/rtx-4090-vs-a100-40gb)

## 包含内容

- ### 无需身份核验

  无需证件，无需自拍照，无需电话号码，无需公司注册信息。

  无核验 · 不限消费
- ### 整张显卡

  GPU 直通到一台服务器，这台服务器就是您的。

  无 MIG · 无 vGPU · 无虚拟化管理程序
- ### Root 与 IPMI

  从第一分钟起即拥有完整 root 权限，另加远程电源控制与虚拟介质。

  带外管理，独立 VLAN
- ### 不限流量

  没有包含流量额度，没有超额档位，没有需要盯着图表看的东西。

  1 到 25 Gbit/s · 双向
- ### 无开通费或重装费

  可随时重装系统，切换到我们提供的任意操作系统。

  $0 · 重装次数不限
- ### 硬件更换，速度快

  取自同一机房内储备的备件，随时更换，硬盘保持原位不动。

  四小时目标 · 24/7

## 在哪些机房可用

每一种 RTX 4090 配置在全部 6个数据中心均可提供。没有哪个机房的价格更高，也没有哪个机房缺货。

AMS 可用

### 阿姆斯特丹

荷兰

往返时间 7 ms 到法兰克福，12 ms 到伦敦

机房 Tier III · 100% 风能

STO 可用

### 斯德哥尔摩

瑞典

往返时间 22 ms 到法兰克福，31 ms 到伦敦

机房 Tier III · 100% 水电

ZRH 可用

### 苏黎世

瑞士

往返时间 9 ms 到米兰，15 ms 到法兰克福

机房 Tier IV · 96% 无碳

REY 可用

### 雷克雅未克

冰岛

往返时间 18 ms 到伦敦，40 ms 到纽约

机房 Tier III · 100% 地热能 + 水电

YUL 可用

### 蒙特利尔

加拿大

往返时间 12 ms 到纽约，19 ms 到多伦多

机房 Tier III · 99% 水电

SIN 可用

### 新加坡

新加坡

往返时间 38 ms 到东京，45 ms 到悉尼

机房 Tier III · 电网 + REC 抵消

## 关于 RTX 4090 服务器的常见问题

RTX 4090 服务器每月费用是多少？

单卡 RTX 4090 服务器每月 $193，一切均已包含：128 GB 系统内存、2 × 2 TB NVMe、不限流量的 1 Gbit/s、1个 IPv4 地址和一段可路由的 IPv6 /64。没有开通费，也没有带宽费用。多 GPU 节点价格从 2卡 $416 起，最高至 8卡 $1,579。

RTX 4090 有多少显存，能放下什么模型？

每张显卡 24 GB GDDR6X，带宽 1,008 GB/s。它在 8k 上下文下单卡能放下的最大模型是 Qwen 3 32B（4-bit (AWQ, GPTQ)）。8卡节点总共有 192 GB 显存，足以容纳 Qwen 3 235B-A22B (MoE)。

RTX 4090 是独享的，还是与其他客户共享？

独享。显卡直通给唯一一台物理机，只有您在其上拥有账户——没有 MIG 分区，没有 vGPU 层，同一芯片上也没有其他租户。在多 GPU 节点上，您获得整个节点，包括显卡之间的 PCIe 5.0 ×16 互联结构。

我租用 RTX 4090 需要核验身份吗？

不需要。无论消费金额多高，都无需上传证件、无需自拍照、无需手机号，也无需公司注册信息——8卡节点与最便宜的单卡在开通条件上完全相同。开户只需要邮箱地址、密码和账单地址，且一律不做核验。

我该如何付款，服务器交付需要多久？

仅接受加密货币：Bitcoin, Monero, Ethereum (ERC-20), Tether (ERC-20) 及其他币种。每笔账单都有独立的收款地址，金额按开具时显示的汇率固定，首次确认后机器即刻开通——under 5 minutes 内即可获得 root 权限，全天候不限时间。

我可以按小时租用 RTX 4090 吗？

不是的。本站所有价格都是月费，没有计量计费，也没有按秒计费。相较于典型的 $2.99/小时云服务，只要机器存在时间超过约 65 小时——三十天中约 3 天——按月租用就更划算。

## 专属于您的 An RTX 4090，$193/月起。

已在全部 6个数据中心上架、完成烤机，随时待命。用加密货币付款，under 5 minutes 内即属于您。

[配置此服务器](https://gpuserver.io/zh/configure?c=rtx4090-x1) [阅读指南](https://gpuserver.io/zh/guides)

## 相关页面

- [硬件政策 我们运营的十二款 NVIDIA GPU 型号、节点出售前 72 小时的烤机测试、四小时内完成更换的目标，以及不同租户之间硬盘是如何被擦除的。](https://gpuserver.io/zh/hardware)
- [指南 八篇实用指南：显存选型、NVLink 对比 PCIe、图像与视频模型、月付对比按小时、自建对比 API、部署 Llama 70B，以及 QLoRA。](https://gpuserver.io/zh/guides)
- [文档 首次通过 SSH 连接、硬件验证、CUDA 容器、用 vLLM 部署模型、RAID、防火墙配置、IPMI 与系统重装——都是在真实服务器上执行的实际命令。](https://gpuserver.io/zh/docs)
- [网络 每个站点提供最高 25 Gbit/s 不限流量端口、两家运营商与一个 IX、全天候 DDoS 过滤、可路由 IPv6——以及我们明确不提供的四件事。](https://gpuserver.io/zh/network)

---

来源：https://gpuserver.io/zh/gpu/rtx-4090/。本文件由与网站相同的数据生成；如果此处的数字与页面不一致，以页面为准，本文件视为过期——权威来源是 https://gpuserver.io/。
