Todos os 6 centros de dados operacionais

Pago em cripto · Sem verificação de identidade · Acesso root em em menos de 5 minutos

Infraestrutura

O que instalamos em rack, e o que acontece quando quebra.

Um servidor dedicado é uma promessa sobre um objeto físico. Esta página descreve esse objeto: quais placas compramos, como um nó é testado antes de receber um locatário, e o que fazemos no dia em que um deles morre.

  • 12Modelos de GPU que operamos
  • 72 hamaciamento antes de um nó receber um locatário
  • 4 hmeta para substituir hardware com falha
  • 0placas revendidas de outro provedor

Toda placa que operamos

Esta é a lista completa — não há nível não listado nem placa reservada para contas maiores. A largura de banda de memória está na tabela porque, para inferência, ela prevê o throughput muito melhor do que qualquer valor de teraflops.

Modelos de GPU, arquitetura, memória, largura de banda, tamanhos de nó e preço de entrada
Placa Arquitetura Memória Largura de banda Tamanhos de nó A partir de
L4 Placa de expansão PCIe Ada Lovelace 24 GB GDDR6 300 GB/s 1×, 2×, 4×, 8×, 10× $125/mês
RTX 4090 Placa de expansão PCIe Ada Lovelace 24 GB GDDR6X 1,008 GB/s 1×, 2×, 4×, 8× $193/mês
RTX 5090 Placa de expansão PCIe Blackwell 32 GB GDDR7 1,792 GB/s 1×, 2×, 4×, 8× $335/mês
RTX A6000 Placa de expansão PCIe Ampere 48 GB GDDR6 ECC 768 GB/s 1×, 2×, 4×, 8× $286/mês
L40S Placa de expansão PCIe Ada Lovelace 48 GB GDDR6 ECC 864 GB/s 1×, 2×, 4×, 8× $714/mês
A100 PCIe Placa de expansão PCIe Ampere 40 GB HBM2 1,555 GB/s 1×, 2×, 4×, 8× $392/mês
A100 PCIe Placa de expansão PCIe Ampere 80 GB HBM2e 1,935 GB/s 1×, 2×, 4×, 8× $1,091/mês
H100 PCIe Placa de expansão PCIe Hopper 80 GB HBM3 2,000 GB/s 1×, 2×, 4×, 8× $1,469/mês
A100 SXM4 Módulo SXM, placa HGX Ampere 80 GB HBM2e 2,039 GB/s 4×, 8× $4,395/mês
H100 SXM5 Módulo SXM, placa HGX Hopper 80 GB HBM3 3,350 GB/s 4×, 8× $6,061/mês
H200 SXM5 Módulo SXM, placa HGX Hopper 141 GB HBM3e 4,800 GB/s 4×, 8× $8,405/mês
B200 SXM6 Módulo SXM, placa HGX Blackwell 180 GB HBM3e 8,000 GB/s 4×, 8× $11,790/mês

Toda placa é uma peça de varejo ou OEM comprada nova, com a garantia em nosso nome. Não compramos estoque ex-mineração, e não compramos placas cujo histórico não conseguimos rastrear — uma RTX 4090 usada é barata por um motivo, e o motivo chega no quarto mês.

O que envolve as placas

Uma GPU privada de CPU, RAM ou throughput de disco é uma forma cara de esperar. O chassi é escolhido pela quantidade de placas, não vendido como um caminho de upgrade.

Especificação do chassi por quantidade de GPUs
CPU RAM do sistema Armazenamento local Porta
1 × GPU AMD Ryzen 9 7950X 16 núcleos / 32 threads · ou Intel Xeon Silver 4410Y 128 GB 2 × 2 TB NVMeGen4 U.2, sem RAID imposto 1 Gbit/s
2 × GPU AMD Threadripper 7960X 24 núcleos / 48 threads · ou Intel Xeon Gold 5416S 256 GB 2 × 3.84 TB NVMeGen4 U.2, sem RAID imposto 2 Gbit/s
4 × GPU AMD Threadripper 7970X 32 núcleos / 64 threads · ou 2 × Intel Xeon Gold 6438Y+ 512 GB 4 × 3.84 TB NVMeGen4 U.2, sem RAID imposto 10 Gbit/s
8 × GPU 2 × Intel Xeon Gold 6438Y+ 64 núcleos · ou 2 × Intel Xeon Platinum 8462Y+ 1 TB 8 × 3.84 TB NVMeGen4 U.2, sem RAID imposto 25 Gbit/s
10 × GPU 2 × Intel Xeon Platinum 8462Y+ 64 núcleos · ou 2 × Intel Xeon Platinum 8462Y+ 1 TB 8 × 7.68 TB NVMeGen4 U.2, sem RAID imposto 25 Gbit/s

Quando duas CPUs estão listadas, qualquer uma delas pode ser entregue — elas são equivalentes em número de núcleos e canais de memória, e o configurador mostra qual delas o seu nó tem antes de você pagar. Os discos são entregues no estado bruto: não impomos nenhum nível de RAID, porque o nível correto depende de você estar armazenando checkpoints ou um dataset que pode baixar novamente.

Antes de um nó ser vendido

Uma máquina só chega ao catálogo depois de passar três dias tentando falhar sem sucesso. Quase toda placa que vai morrer cedo morre aqui, em nossas mãos, e não nas suas.

ETAPA 1 · 2 HORAS

Montagem e inventário

Os números de série de cada placa, módulo e disco são registrados em relação ao chassi. Esse registro é o que nos permite dizer a você, depois, exatamente qual peça física está na sua máquina.

ETAPA 2 · 24 HORAS

Teste de estresse de memória e computação

Testes de padrão ECC em toda a VRAM de cada placa, seguidos de multiplicação de matrizes sustentada a 100% de utilização. Um único erro não corrigível e a placa volta para a caixa.

ETAPA 3 · 24 HORAS

Teste térmico e de potência

O nó inteiro é mantido em carga total enquanto a temperatura de entrada é elevada ao pior caso da sala. Registramos o clock que as placas realmente sustentam — não o valor de boost da caixa — e um nó que reduz o clock abaixo da especificação é reencaixado ou tem a pasta térmica refeita antes de ser testado novamente.

ETAPA 4 · 24 HORAS

Interconexão e armazenamento

Largura de banda peer-to-peer de NVLink ou PCIe medida entre placas, resistência de escrita do NVMe amostrada, porta mantida na taxa de linha. Os números são comparados com os de outros nós do mesmo modelo, porque um nó 15% mais lento é um nó com problema.

DEPOIS · EM RACK E AGUARDANDO

Disponível, com uma imagem pronta para gravar

É por isso que a entrega é em menos de 5 minutos, e não um dia útil: nada é montado quando você faz o pedido. A máquina já existe, ligada e testada, e seu pagamento aciona a gravação de uma imagem, não uma montagem.

Firmware e drivers

Pilha de drivers Instalado, fixado, seu para alterar Toda imagem Linux já vem com um driver NVIDIA atual, CUDA, cuDNN e NCCL funcionando. Nada impede você de substituir tudo isso — o root é seu.
Atualizações de firmware Nunca durante o seu prazo BIOS, BMC e VBIOS são configurados antes de o nó entrar no catálogo. Não enviamos firmware para uma máquina que alguém está alugando; isso é aplicado entre locatários.
Clocks Em estoque, e liberado para você Enviamos cada placa com o clock e o limite de potência de referência. Você pode aumentá-los ou reduzi-los com nvidia-smi; a consequência para a garantia é nossa, não sua.
Acesso fora de banda IPMI, em uma rede separada Energia remota, console serial e mídia virtual, acessíveis mesmo quando o sistema operacional não está. Fica em uma VLAN de gerenciamento que nunca toca a sua porta pública.

Quando algo falha

Hardware quebra. O que diferencia os provedores não é se isso acontece, mas como são as próximas quatro horas.

As peças de reposição estão no local

Cada sala mantém placas de reposição, fontes de alimentação, discos e um chassi completo por modelo. Uma substituição é uma caminhada até o corredor, não um agendamento de transportadora.

Meta de quatro horas

Do seu relato até o hardware funcionando novamente, 24 horas por dia. Se não cumprirmos, o SLA estende seu prazo automaticamente — você não precisa solicitar.

Seus discos continuam seus

Uma GPU ou fonte de alimentação com defeito é trocada com os discos intocados e no lugar. Só pedimos permissão antes de mexer no armazenamento, e somente quando o armazenamento é o que falhou.

Um disco com defeito não é legível pelo próximo locatário. Unidades retiradas de serviço são apagadas se ainda respondem, e destruídas fisicamente se não respondem. Um disco morto não pode ser apagado, então nunca é devolvido a um fabricante sob garantia — nós absorvemos esse custo em vez de deixar uma unidade que já teve seus dados sair do prédio intacta.

Entre dois locatários

A mesma máquina será alugada novamente depois de você. Tudo o que vem abaixo acontece antes que ela volte ao catálogo, quer alguém pergunte ou não.

Etapas de desativação entre dois locatários
EtapaO que aconteceVerificado por
1. RedeA máquina é cortada da sua porta pública no momento em que o prazo termina. Nada fica acessível enquanto ela espera.Estado da porta, registrado
2. ArmazenamentoTodo dispositivo NVMe recebe uma limpeza criptográfica completa, seguida de uma sobrescrita de passagem única em todo o espaço de endereçamento.Amostra de releitura em cada dispositivo
3. Memória de GPUAs placas são reiniciadas e sua memória é limpa; os contadores ECC são lidos e comparados com os valores registrados no amaciamento.log de reset do nvidia-smi
4. FirmwareAs configurações de BMC e BIOS são regravadas para a nossa referência, descartando qualquer alteração feita durante o prazo.Checksum contra a referência
5. IdentidadeCredenciais de IPMI rotacionadas, endereços IP devolvidos ao pool, rDNS limpo.Endereço retido até ficar limpo

É também por isso que não podemos restaurar nada depois que um prazo termina. Não há período de carência durante o qual seus dados ainda existem em algum lugar — a etapa 2 já foi executada. Se precisar deles, retire-os da máquina antes que o prazo se encerre.

O que não faremos

Particionar uma placa. Sem MIG, sem vGPU, sem time-slicing. Um locatário por GPU física, o que torna o throughput da listagem reprodutível.

Sobrealocar um nó. Não existe uma segunda conta na máquina, nem um hipervisor entre você e o hardware.

Revender a capacidade de outra empresa. Toda placa nesta página é uma placa que compramos e instalamos em rack. Nada aqui é margem de revenda sobre outra nuvem.

Substituir por uma placa diferente. Se o modelo que você pediu não puder ser entregue, não enviamos silenciosamente algo quase equivalente — avisamos você e reembolsamos o prazo.

Entrar no seu sistema operacional. O root é só seu. Temos IPMI, que pode reiniciar a energia e montar mídia; não guardamos um login dentro da sua máquina.

Guardar uma cópia de qualquer coisa. Não fazemos backup dos seus discos. Snapshots só existem se você comprá-los, e são apagados junto com o prazo.

A especificação na linha é a especificação que você recebe.

Toda placa acima está disponível em todos os 6 centros de dados, instalada em rack e com amaciamento feito, com uma imagem pronta para gravar.

Entrar

Console, faturas e acesso fora de banda.

Ainda não tem uma conta?

Não existe cadastro separado. Sua conta é criada enquanto você faz seu primeiro pedido — você escolhe o e-mail e a senha na etapa de pagamento, e o console já está aberto quando a máquina estiver pronta.

Configurar um servidor

Language