Todos os 6 centros de dados operacionais

Pago em cripto · Sem verificação de identidade · Acesso root em em menos de 5 minutos

Ada Lovelace · Placa PCIe

Alugue um servidor GPU L4 dedicado.

24 GB de GDDR6 a 300 GB/s, numa máquina só sua. Mensal, pago em cripto, aberta sem verificação de identidade e entregue em under 5 minutes.

  • $125/mouma placa, tudo incluído
  • 24 GBGDDR6
  • 300 GB/slargura de banda de memória
  • 1×, 2×, 4×, 8×, 10×tamanhos de nó disponíveis

Preço, por tamanho de nó e prazo

Um número por linha, e é o número inteiro: sem taxa de instalação, sem taxa de reinstalação, sem cobrança de banda, sem plano de suporte. Prazos mais longos são pagos antecipadamente.

Preço mensal de um servidor L4, por tamanho de nó e duração do prazo
CPU e memória Mensal 3 meses 12 meses
1 × L4 24 GB no total · PCIe 5.0 Intel Xeon Silver 4410Y12 núcleos / 24 threads · 128 GB · 2 × 2 TB NVMe $125/mês cancelar a qualquer momento $119/mês economize $18/ano $110/mês economize $180/ano Configurar
2 × L4 48 GB no total · PCIe 5.0 ×16 Intel Xeon Gold 5416S16 núcleos / 32 threads · 256 GB · 2 × 3.84 TB NVMe $285/mês cancelar a qualquer momento $271/mês economize $42/ano $251/mês economize $408/ano Configurar
4 × L4 96 GB no total · PCIe 5.0 ×16 2 × Intel Xeon Gold 6438Y+64 núcleos · 512 GB · 4 × 3.84 TB NVMe $564/mês cancelar a qualquer momento $536/mês economize $84/ano $496/mês economize $816/ano Configurar
8 × L4 192 GB no total · PCIe 5.0 ×16 2 × Intel Xeon Platinum 8462Y+64 núcleos · 1 TB · 8 × 3.84 TB NVMe $1,106/mês cancelar a qualquer momento $1,051/mês economize $165/ano $973/mês economize $1,596/ano Configurar
10 × L4 240 GB no total · PCIe 5.0 ×16 2 × Intel Xeon Platinum 8462Y+64 núcleos · 1 TB · 8 × 7.68 TB NVMe $1,371/mês cancelar a qualquer momento $1,302/mês economize $207/ano $1,206/mês economize $1,980/ano Configurar

Cada configuração acima está disponível em todos os 6 centros de dados, instalada em rack e com amaciamento feito, com uma imagem pronta para gravar — por isso a entrega é under 5 minutes, em vez de um dia útil.

Especificação completa

GPUNVIDIA L4Arquitetura Ada Lovelace, Placa de expansão PCIe.
Memória24 GB GDDR6300 GB/s de largura de banda — o número que prevê a velocidade de geração, muito melhor do que qualquer número de teraflops.
InterconexãoPCIe 5.0 ×16Ponto a ponto pelo PCIe. Adequado para um modelo por placa e para paralelismo de pipeline; mais lento que o NVLink para paralelismo de tensores. Qual delas o seu trabalho exige.
Tamanhos de nó1 × placa, 2 × placa, 4 × placa, 8 × placa, 10 × placaPlacas PCIe vão até oito num chassi padrão, e dez apenas em placas de baixo consumo.
Armazenamento2 × 2 TB NVMeEntregue em estado bruto além do volume de sistema — não impomos nenhum nível de RAID. Mais NVMe e HDD de arquivamento são opções mensais.
Rede1 Gbit/s, sem contadorNas duas direções, sem volume incluído e sem excedente em nenhum nível de tráfego. Um IPv4, um /64 IPv6 roteado, filtragem DDoS ativa desde a entrega.

O que roda em an L4

Cada modelo abaixo cabe numa única placa a 8k de contexto — sem sharding, sem interconexão para se preocupar. A precisão mostrada é a melhor que cabe; a conta está no guia de dimensionamento de VRAM, para você conferir.

Modelos de linguagem que cabem numa única L4 a 8k de contexto
ModeloMelhor precisão que cabeMemória necessáriaTokens/s estimados
Llama 3.1 8B8B de parâmetros BF16 / FP16Qualidade de referência 20 GBde 24 GB ~8
Qwen 3 32B32B de parâmetros 4-bit (AWQ, GPTQ)Pesos menores, cache permanece em FP16 21 GBde 24 GB ~8
Mistral Small 24B24B de parâmetros 4-bit (AWQ, GPTQ)Pesos menores, cache permanece em FP16 15 GBde 24 GB ~11
Gemma 3 27B27B de parâmetros 4-bit (AWQ, GPTQ)Pesos menores, cache permanece em FP16 20 GBde 24 GB ~10
Phi-4 14B14B de parâmetros FP8Quase referência, Hopper e Blackwell 17 GBde 24 GB ~10

No nó de 10 placas, os mesmos modelos são distribuídos por 240 GB no total, o que muda completamente o que é possível — até Llama 3.1 405B. O sharding custa sincronização em cada camada, então um modelo que cabe numa placa deve permanecer numa placa.

Throughput esperado

A geração é limitada pela largura de banda de memória: cada token exige reler os pesos ativos. A 300 GB/s, isso impõe um teto que nenhum ajuste consegue superar.

Nossos números são um piso, não uma promessa. As estimativas nesta página são calibradas com base em medições publicadas e são deliberadamente conservadoras — elas modelam a geração em fluxo único. Com processamento contínuo por lotes no vLLM, o agregado entre requisições simultâneas é várias vezes maior. Se um número aqui parecer baixo em comparação com um benchmark que você já viu, geralmente essa é a diferença.

Comparado com placas próximas

As três placas mais próximas desta em preço. A memória decide o que carrega; a largura de banda decide com que rapidez ela responde.

A L4 comparada com as três placas mais próximas em preço
PlacaMemóriaLargura de bandaInterconexãoA partir de
L4 Esta páginaAda Lovelace 24 GB 300 GB/s PCIe $125/mês
RTX 4090Ada Lovelace 24 GB 1,008 GB/s PCIe $193/mês
RTX A6000Ampere 48 GB 768 GB/s PCIe $286/mês
RTX 5090Blackwell 32 GB 1,792 GB/s PCIe $335/mês

Veja todas as 12 placas lado a lado, ou deixe o configurador escolher a partir do seu modelo e comprimento de contexto, em vez de a partir de um preço.

Comparado com outras placas

As comparações que as pessoas de fato fazem em relação a an L4, cada uma calculada por preço, memória, largura de banda e os modelos que cabem.

O que está incluído

  • Sem verificação de identidade

    Sem documento, sem selfie, sem número de telefone, sem registro da empresa.

    Nada verificado · em qualquer valor gasto

  • A placa inteira

    A GPU é atribuída em passthrough a uma única máquina, e essa máquina é sua.

    Sem MIG · sem vGPU · sem hipervisor

  • Root e IPMI

    Root completo desde o primeiro minuto, além de energia remota e mídia virtual.

    Fora de banda, em sua própria VLAN

  • Largura de banda sem contador

    Sem volume incluído, sem nível de excedente, nada para observar em um gráfico.

    1 a 25 Gbit/s · nas duas direções

  • Sem taxa de instalação ou reinstalação

    Reinstale a imagem quantas vezes quiser, para qualquer sistema operacional que oferecemos.

    $0 · reinstalações ilimitadas

  • Hardware trocado, rápido

    A partir de peças de reposição guardadas na mesma sala, a qualquer hora, com os discos mantidos no lugar.

    Meta de quatro horas · 24/7

Onde você pode tê-la

Cada configuração de L4 está disponível em todos os 6 centros de dados. Não há site onde uma placa custe mais, nem nenhum onde esteja indisponível.

AMS Disponível

Amsterdã

Países Baixos

Ida e volta7 ms até Frankfurt, 12 ms até Londres
InstalaçãoTier III · 100% eólica
STO Disponível

Estocolmo

Suécia

Ida e volta22 ms até Frankfurt, 31 ms até Londres
InstalaçãoTier III · 100% hídrica
ZRH Disponível

Zurique

Suíça

Ida e volta9 ms até Milão, 15 ms até Frankfurt
InstalaçãoTier IV · 96% livre de carbono
REY Disponível

Reykjavík

Islândia

Ida e volta18 ms até Londres, 40 ms até Nova York
InstalaçãoTier III · 100% geotérmica + hídrica
YUL Disponível

Montreal

Canadá

Ida e volta12 ms até Nova York, 19 ms até Toronto
InstalaçãoTier III · 99% hídrica
SIN Disponível

Cingapura

Cingapura

Ida e volta38 ms até Tóquio, 45 ms até Sydney
InstalaçãoTier III · Rede + compensação REC

Perguntas sobre servidor L4

Quanto custa um servidor L4 por mês?
Um servidor L4 de uma placa custa $125 por mês, com tudo incluído: 128 GB de RAM do sistema, 2 × 2 TB NVMe, 1 Gbit/s sem contador, um endereço IPv4 e um /64 IPv6 roteado. Não há taxa de instalação nem cobrança de banda. Nós multi-GPU vão de $285 para 2 placas até $1,371 para 10.
Quanta VRAM tem a L4, e o que cabe nela?
24 GB de GDDR6 por placa, a 300 GB/s. O maior modelo que ela comporta numa placa a 8k de contexto é Qwen 3 32B (4-bit (AWQ, GPTQ)).Um nó de 10 placas tem 240 GB no total, suficiente para Llama 3.1 405B.
A L4 é dedicada, ou compartilhada com outros clientes?
Dedicada. A placa é repassada por passthrough a uma única máquina física na qual só você tem conta — sem particionamento MIG, sem camada de vGPU e sem nenhum outro locatário no mesmo silício. Num nó multi-GPU, você recebe o nó inteiro, incluindo o fabric PCIe 5.0 ×16 entre as placas.
Preciso verificar minha identidade para alugar um L4?
Não. Não há envio de documento, nem selfie, nem número de telefone, nem registro de empresa, em nenhum nível de gasto — um nó de oito placas abre exatamente nas mesmas condições que a placa avulsa mais barata. Abrir uma conta exige um endereço de e-mail, uma senha e um endereço de cobrança, e nada disso é verificado.
Como eu pago, e com que rapidez o servidor é entregue?
Somente em criptomoeda: Bitcoin, Monero, Ethereum (ERC-20), Tether (ERC-20) e outras. Cada fatura recebe seu próprio endereço, o valor é fixado à taxa mostrada no momento da emissão, e a máquina é provisionada na primeira confirmação — acesso root em under 5 minutes, a qualquer hora.
Posso alugar um L4 por hora, em vez de por mês?
Não aqui. Todo preço deste site é um preço mensal, sem contador e sem cobrança por segundo. Contra uma nuvem típica de $2.99/hora, um prazo mensal fica mais barato a partir de cerca de 42 horas da máquina simplesmente existindo — cerca de 2 dias em trinta.

An L4 só seu, a partir de $125 por mês.

Instalada em rack, com amaciamento feito e à espera em todos os 6 centros de dados. Pague em cripto e ela é sua em under 5 minutes.

Entrar

Console, faturas e acesso fora de banda.

Ainda não tem uma conta?

Não existe cadastro separado. Sua conta é criada enquanto você faz seu primeiro pedido — você escolhe o e-mail e a senha na etapa de pagamento, e o console já está aberto quando a máquina estiver pronta.

Configurar um servidor

Language