Guías.
Textos más extensos sobre las preguntas que determinan qué máquina alquilar — escritos a partir del hardware que realmente operamos, con la aritmética a la vista.
- Escrito sobre el hardware que operamos
- Comandos que puede pegar, no pseudocódigo
- Aritmética mostrada, para que pueda comprobarla
Las 10 guías
5 on dimensionamiento · 2 on coste · 2 on práctica · 1 on pago
-
Dimensionamiento · 9 min
Cuánta VRAM necesita realmente un modelo
La aritmética que hay detrás de «¿cabe?»: los pesos, la caché KV, y los dos puntos en los que una regla general se equivoca por un factor de tres.
Leer la guía -
Dimensionamiento · 7 min
NVLink o PCIe: cuál necesita su carga de trabajo
Cuándo el enlace entre tarjetas decide su rendimiento, cuándo no cambia nada, y cómo saber en qué caso está antes de pagar por el nodo equivocado.
Leer la guía -
Dimensionamiento · 9 min
Elegir una tarjeta para modelos de imagen y vídeo
Cuánta VRAM necesitan FLUX, SDXL, SD 3.5 y Wan 2.1, qué tarjeta de nuestro catálogo aloja cada uno, y por qué la más barata que cabe rara vez es la más indicada.
Leer la guía -
Dimensionamiento · 10 min
Elegir un formato de cuantización
Lo que cuestan AWQ, GPTQ, GGUF y FP8 en memoria, velocidad y calidad — y por qué el formato con los pesos más pequeños rara vez da el modelo más pequeño.
Leer la guía -
Dimensionamiento · 10 min
Ejecutar un modelo de mezcla de expertos
Los parámetros totales deciden la máquina; los activos, la velocidad. Cuánta VRAM necesitan DeepSeek V3 y Qwen 3 235B, y qué nodo alquilar para ellos.
Leer la guía -
Coste · 6 min
Cuándo el alquiler mensual gana al alquiler por horas
El punto de equilibrio con cifras reales, los tres costes que un precio por hora oculta hasta la factura, y la trampa del tiempo inactivo que la triplica.
Leer la guía -
Coste · 9 min
Autoalojamiento frente a una API por token
El punto de equilibrio entre pagar una API por token y alquilar una GPU, con nuestros precios y rendimiento reales — y las cuatro cosas que la aritmética omite.
Leer la guía -
Práctica · 11 min
Servir Llama 3.3 70B en un nodo
De una máquina entregada a un endpoint compatible con OpenAI, con los parámetros que importan y los dos que reducen a la mitad su rendimiento sin avisar.
Leer la guía -
Práctica · 10 min
Fine-tuning de un modelo de 70B en una sola tarjeta
QLoRA en una sola GPU de 48 GB: qué cabe, cuánto cuesta al mes y por qué el fine-tuning completo exige otro tipo de máquina.
Leer la guía -
Pago · 8 min
Pagar un servidor en cripto
Qué ocurre realmente entre pulsar pagar y obtener root, qué moneda elegir, y los cuatro errores que hacen perder dinero en un primer pago.
Leer la guía
Ten preguntas deciden qué máquina debería alquilar.
Preferimos escribir ten artículos que respondan a una pregunta real que sesenta que posicionen para un término de búsqueda. Cada guía anterior existe porque es una pregunta que nos hacen antes de un pedido, y cada una está escrita sobre las tarjetas de nuestro propio catálogo: las cifras que contienen son cifras de máquinas que operamos.
Cuando una guía muestra una fórmula, es la misma fórmula que usa el configurador para indicarle si un modelo cabe. Eso es deliberado: debería poder comprobar nuestra aritmética en lugar de fiarse del visto verde.
Directo al grano
Si ya sabe lo que necesita
Todas las guías terminan en el mismo sitio.
Una máquina que puede alquilar al mes, pagar en cripto y abrir sin demostrar quién es.