Guias.
Textos mais longos sobre as perguntas que decidem qual máquina alugar — escritos com base no hardware que realmente operamos, com a aritmética à mostra.
- Escrito com base no hardware que operamos
- Comandos que você pode colar, não pseudocódigo
- Aritmética exibida, para você conferir
Todos os 10 guias
5 on dimensionamento · 2 on custo · 2 on prática · 1 on pagamento
-
Dimensionamento · 9 min
Quanta VRAM um modelo realmente precisa
A aritmética por trás de “será que cabe”: pesos, cache KV, e os dois pontos em que uma regra prática erra por um fator de três.
Ler o guia -
Dimensionamento · 7 min
NVLink ou PCIe: de qual seu trabalho precisa
Quando o link entre placas decide seu throughput, quando não muda nada, e como saber em qual caso você está antes de pagar pelo nó errado.
Ler o guia -
Dimensionamento · 9 min
Escolhendo uma placa para modelos de imagem e vídeo
O que FLUX, SDXL, SD 3.5 e Wan 2.1 precisam em VRAM, qual placa do nosso catálogo comporta cada um, e por que a mais barata que cabe raramente é a certa para alugar.
Ler o guia -
Dimensionamento · 10 min
Escolhendo um formato de quantização
O que AWQ, GPTQ, GGUF e FP8 custam em memória, velocidade e qualidade — e por que o formato com os menores pesos raramente dá o menor modelo.
Ler o guia -
Dimensionamento · 10 min
Rodando um modelo de mistura de especialistas
Parâmetros totais decidem a máquina, parâmetros ativos decidem a velocidade. O que o DeepSeek V3 e o Qwen 3 235B precisam em VRAM, e qual nó alugar para eles.
Ler o guia -
Custo · 6 min
Quando o aluguel mensal supera o por hora
O ponto de equilíbrio calculado com números reais, três custos que um preço por hora esconde até a fatura, e a armadilha do tempo ocioso que triplica uma estimativa.
Ler o guia -
Custo · 9 min
Hospedagem própria contra uma API por token
O ponto de equilíbrio entre pagar uma API por token e alugar uma GPU, calculado com nossos preços e throughput — e as quatro coisas que a aritmética deixa de fora.
Ler o guia -
Prática · 11 min
Servindo o Llama 3.3 70B em um nó
De uma máquina entregue a um endpoint compatível com OpenAI, com as flags que importam e as duas que reduzem seu throughput pela metade, silenciosamente.
Ler o guia -
Prática · 10 min
Fine-tuning de um modelo de 70B em uma placa
QLoRA em uma única GPU de 48 GB: o que cabe, quanto custa por mês, e por que o fine-tuning completo exige outra categoria de máquina.
Ler o guia -
Pagamento · 8 min
Pagando um servidor em cripto
O que realmente acontece entre clicar em pagar e receber o root, qual moeda escolher, e os quatro erros que fazem perder dinheiro no primeiro pagamento.
Ler o guia
Ten perguntas decidem qual máquina você deve alugar.
Preferimos escrever ten textos que respondam a uma pergunta real do que sessenta que rankeiem para um termo de busca. Cada guia acima existe porque é uma pergunta que nos fazem antes de um pedido, e cada um é escrito com base nas placas do nosso próprio catálogo — os números neles são números de máquinas que operamos.
Onde um guia mostra uma fórmula, é a mesma fórmula que o configurador usa para dizer se um modelo cabe. Isso é proposital: você deve poder conferir nossa aritmética, em vez de confiar cegamente no tique verde.
Direto ao ponto
Se você já sabe do que precisa
Todo guia termina no mesmo lugar.
Uma máquina que você pode alugar por mês, pagar em cripto e abrir sem provar quem você é.