Ampere · Módulo SXM

# Alugue um servidor GPU A100 SXM4 dedicado.

80 GB de HBM2e a 2,039 GB/s, numa máquina só sua. Mensal, pago em cripto, aberta sem verificação de identidade e entregue em under 5 minutes.

- $4,395/mo uma placa, tudo incluído
- 80 GB HBM2e
- 2,039 GB/s largura de banda de memória
- 4×, 8× tamanhos de nó disponíveis

## Preço, por tamanho de nó e prazo

Um número por linha, e é o número inteiro: sem taxa de instalação, sem taxa de reinstalação, sem cobrança de banda, sem plano de suporte. Prazos mais longos são pagos antecipadamente.

**Preço mensal de um servidor A100 SXM4, por tamanho de nó e duração do prazo**

| Nó | CPU e memória | Mensal | 3 meses | 12 meses |  |
|---|---|---|---|---|---|
| 4 × A100 SXM4 320 GB no total · NVLink 3 · 600 GB/s | 2 × Intel Xeon Gold 6438Y+64 núcleos · 512 GB · 4 × 3.84 TB NVMe | $4,395/mês cancelar a qualquer momento | $4,175/mês economize $660/ano | $3,868/mês economize $6,324/ano | [Configurar](https://gpuserver.io/pt/configure?c=a100-sxm-x4) |
| 8 × A100 SXM4 640 GB no total · NVLink 3 · 600 GB/s | 2 × Intel Xeon Platinum 8462Y+64 núcleos · 1 TB · 8 × 3.84 TB NVMe | $8,355/mês cancelar a qualquer momento | $7,937/mês economize $1,254/ano | $7,352/mês economize $12,036/ano | [Configurar](https://gpuserver.io/pt/configure?c=a100-sxm-x8) |

Cada configuração acima está disponível em todos os 6 centros de dados, instalada em rack e com amaciamento feito, com uma imagem pronta para gravar — por isso a entrega é under 5 minutes, em vez de um dia útil.

## Especificação completa

GPU NVIDIA A100 SXM4 Arquitetura Ampere, Módulo SXM num board HGX.

Memória 80 GB HBM2e 2,039 GB/s de largura de banda — o número que prevê a velocidade de geração, muito melhor do que qualquer número de teraflops.

Interconexão NVLink 3 · 600 GB/s Todos-para-todos entre cada placa do board. Paralelismo de tensores sem que o link vire o gargalo. [Qual delas o seu trabalho exige](https://gpuserver.io/pt/guides/nvlink-vs-pcie).

Tamanhos de nó 4 × placa, 8 × placa Placas SXM vivem num board HGX de quatro ou oito — nunca duas, nunca dez.

Armazenamento 4 × 3.84 TB NVMe Entregue em estado bruto além do volume de sistema — não impomos nenhum nível de RAID. Mais NVMe e HDD de arquivamento são opções mensais.

Rede 10 Gbit/s, sem contador Nas duas direções, sem volume incluído e sem excedente em nenhum nível de tráfego. Um IPv4, um /64 IPv6 roteado, filtragem DDoS ativa desde a entrega.

## O que roda em an A100 SXM4

Cada modelo abaixo cabe numa *única* placa a 8k de contexto — sem sharding, sem interconexão para se preocupar. A precisão mostrada é a melhor que cabe; a conta está no [guia de dimensionamento de VRAM](https://gpuserver.io/pt/guides/vram-sizing), para você conferir.

**Modelos de linguagem que cabem numa única A100 SXM4 a 8k de contexto**

| Modelo | Melhor precisão que cabe | Memória necessária | Tokens/s estimados |
|---|---|---|---|
| Llama 3.1 8B 8B de parâmetros | BF16 / FP16Qualidade de referência | 20 GBde 80 GB | ~57 |
| Llama 3.3 70B 70B de parâmetros | 4-bit (AWQ, GPTQ)Pesos menores, cache permanece em FP16 | 43 GBde 80 GB | ~26 |
| Qwen 3 32B 32B de parâmetros | BF16 / FP16Qualidade de referência | 76 GBde 80 GB | ~14 |
| Mistral Small 24B 24B de parâmetros | BF16 / FP16Qualidade de referência | 57 GBde 80 GB | ~19 |
| Gemma 3 27B 27B de parâmetros | BF16 / FP16Qualidade de referência | 67 GBde 80 GB | ~17 |
| Phi-4 14B 14B de parâmetros | BF16 / FP16Qualidade de referência | 34 GBde 80 GB | ~33 |

No nó de 8 placas, os mesmos modelos são distribuídos por 640 GB no total, o que muda completamente o que é possível — até DeepSeek V3 671B-A37B (MoE). O sharding custa sincronização em cada camada, então um modelo que cabe numa placa deve permanecer numa placa.

## Throughput esperado

A geração é limitada pela largura de banda de memória: cada token exige reler os pesos ativos. A 2,039 GB/s, isso impõe um teto que nenhum ajuste consegue superar.

**Nossos números são um piso, não uma promessa.** As estimativas nesta página são calibradas com base em medições publicadas e são deliberadamente conservadoras — elas modelam a geração em fluxo único. Com processamento contínuo por lotes no vLLM, o *agregado* entre requisições simultâneas é várias vezes maior. Se um número aqui parecer baixo em comparação com um benchmark que você já viu, geralmente essa é a diferença.

## Comparado com placas próximas

As três placas mais próximas desta em preço. A memória decide o que carrega; a largura de banda decide com que rapidez ela responde.

**A A100 SXM4 comparada com as três placas mais próximas em preço**

| Placa | Memória | Largura de banda | Interconexão | A partir de |
|---|---|---|---|---|
| A100 SXM4 Esta página Ampere | 80 GB | 2,039 GB/s | NVLink | $4,395/mês |
| [H100 SXM5](https://gpuserver.io/pt/gpu/h100-sxm5) Hopper | 80 GB | 3,350 GB/s | NVLink | $6,061/mês |
| [H100 PCIe](https://gpuserver.io/pt/gpu/h100-pcie) Hopper | 80 GB | 2,000 GB/s | PCIe | $1,469/mês |
| [A100 PCIe](https://gpuserver.io/pt/gpu/a100-80gb) Ampere | 80 GB | 1,935 GB/s | PCIe | $1,091/mês |

[Veja todas as 12 placas lado a lado](https://gpuserver.io/pt/gpu), ou deixe o [configurador](https://gpuserver.io/pt/configure) escolher a partir do seu modelo e comprimento de contexto, em vez de a partir de um preço.

## Comparado com outras placas

As comparações que as pessoas de fato fazem em relação a an A100 SXM4, cada uma calculada por preço, memória, largura de banda e os modelos que cabem.

- [A100 SXM4 vs H100 SXM5  O salto geracional, na mesma placa Veja a comparação](https://gpuserver.io/pt/compare/h100-sxm5-vs-a100-sxm4)

## O que está incluído

- ### Sem verificação de identidade

  Sem documento, sem selfie, sem número de telefone, sem registro da empresa.

  Nada verificado · em qualquer valor gasto
- ### A placa inteira

  A GPU é atribuída em passthrough a uma única máquina, e essa máquina é sua.

  Sem MIG · sem vGPU · sem hipervisor
- ### Root e IPMI

  Root completo desde o primeiro minuto, além de energia remota e mídia virtual.

  Fora de banda, em sua própria VLAN
- ### Largura de banda sem contador

  Sem volume incluído, sem nível de excedente, nada para observar em um gráfico.

  1 a 25 Gbit/s · nas duas direções
- ### Sem taxa de instalação ou reinstalação

  Reinstale a imagem quantas vezes quiser, para qualquer sistema operacional que oferecemos.

  $0 · reinstalações ilimitadas
- ### Hardware trocado, rápido

  A partir de peças de reposição guardadas na mesma sala, a qualquer hora, com os discos mantidos no lugar.

  Meta de quatro horas · 24/7

## Onde você pode tê-la

Cada configuração de A100 SXM4 está disponível em todos os 6 centros de dados. Não há site onde uma placa custe mais, nem nenhum onde esteja indisponível.

AMS Disponível

### Amsterdã

Países Baixos

Ida e volta 7 ms até Frankfurt, 12 ms até Londres

Instalação Tier III · 100% eólica

STO Disponível

### Estocolmo

Suécia

Ida e volta 22 ms até Frankfurt, 31 ms até Londres

Instalação Tier III · 100% hídrica

ZRH Disponível

### Zurique

Suíça

Ida e volta 9 ms até Milão, 15 ms até Frankfurt

Instalação Tier IV · 96% livre de carbono

REY Disponível

### Reykjavík

Islândia

Ida e volta 18 ms até Londres, 40 ms até Nova York

Instalação Tier III · 100% geotérmica + hídrica

YUL Disponível

### Montreal

Canadá

Ida e volta 12 ms até Nova York, 19 ms até Toronto

Instalação Tier III · 99% hídrica

SIN Disponível

### Cingapura

Cingapura

Ida e volta 38 ms até Tóquio, 45 ms até Sydney

Instalação Tier III · Rede + compensação REC

## Perguntas sobre servidor A100 SXM4

Quanto custa um servidor A100 SXM4 por mês?

Um servidor A100 SXM4 de uma placa custa $4,395 por mês, com tudo incluído: 512 GB de RAM do sistema, 4 × 3.84 TB NVMe, 10 Gbit/s sem contador, um endereço IPv4 e um /64 IPv6 roteado. Não há taxa de instalação nem cobrança de banda. Nós multi-GPU vão de $8,355 para 8 placas até $8,355 para 8.

Quanta VRAM tem a A100 SXM4, e o que cabe nela?

80 GB de HBM2e por placa, a 2,039 GB/s. O maior modelo que ela comporta numa placa a 8k de contexto é Llama 3.1 405B (4-bit (AWQ, GPTQ)).Um nó de 8 placas tem 640 GB no total, suficiente para DeepSeek V3 671B-A37B (MoE).

A A100 SXM4 é dedicada, ou compartilhada com outros clientes?

Dedicada. A placa é repassada por passthrough a uma única máquina física na qual só você tem conta — sem particionamento MIG, sem camada de vGPU e sem nenhum outro locatário no mesmo silício. Num nó multi-GPU, você recebe o nó inteiro, incluindo o fabric NVLink 3 · 600 GB/s entre as placas.

Preciso verificar minha identidade para alugar um A100 SXM4?

Não. Não há envio de documento, nem selfie, nem número de telefone, nem registro de empresa, em nenhum nível de gasto — um nó de oito placas abre exatamente nas mesmas condições que a placa avulsa mais barata. Abrir uma conta exige um endereço de e-mail, uma senha e um endereço de cobrança, e nada disso é verificado.

Como eu pago, e com que rapidez o servidor é entregue?

Somente em criptomoeda: Bitcoin, Monero, Ethereum (ERC-20), Tether (ERC-20) e outras. Cada fatura recebe seu próprio endereço, o valor é fixado à taxa mostrada no momento da emissão, e a máquina é provisionada na primeira confirmação — acesso root em under 5 minutes, a qualquer hora.

Posso alugar um A100 SXM4 por hora, em vez de por mês?

Não aqui. Todo preço deste site é um preço mensal, sem contador e sem cobrança por segundo. Contra uma nuvem típica de $2.99/hora, um prazo mensal fica mais barato a partir de cerca de 1470 horas da máquina simplesmente existindo — cerca de 61 dias em trinta.

## An A100 SXM4 só seu, a partir de $4,395 por mês.

Instalada em rack, com amaciamento feito e à espera em todos os 6 centros de dados. Pague em cripto e ela é sua em under 5 minutes.

[Configurar este servidor](https://gpuserver.io/pt/configure?c=a100-sxm-x4) [Ler os guias](https://gpuserver.io/pt/guides)

## Páginas relacionadas

- [Política de hardware As doze GPUs NVIDIA que operamos, o amaciamento de 72 horas antes da venda de um nó, a meta de troca em quatro horas, e como os discos são apagados entre locatários.](https://gpuserver.io/pt/hardware)
- [Guias Oito guias práticos: dimensionamento de VRAM, NVLink vs PCIe, imagem e vídeo, mensal vs por hora, hospedagem própria vs API, servir o Llama 70B e QLoRA.](https://gpuserver.io/pt/guides)
- [Documentação Primeiro SSH, verificação do hardware, containers CUDA, servir um modelo com vLLM, RAID, firewall, IPMI e reinstalações — os comandos, em uma máquina real.](https://gpuserver.io/pt/docs)
- [Rede Portas sem contador até 25 Gbit/s, duas operadoras e um IX por site, filtragem DDoS sempre ativa, IPv6 roteado — e as quatro coisas que não oferecemos, já ditas.](https://gpuserver.io/pt/network)

---

Fonte: https://gpuserver.io/pt/gpu/a100-sxm4/. Este arquivo é gerado a partir dos mesmos dados que o site; se um número aqui divergir de uma página, a página prevalece e este arquivo está desatualizado — a fonte canônica é https://gpuserver.io/.
