Guides.
Des textes plus longs sur les questions qui déterminent la machine à louer — écrits face au matériel que nous exploitons réellement, calculs à l’appui.
- Rédigé face au matériel que nous exploitons
- Des commandes que vous pouvez copier-coller, pas du pseudocode
- Calcul affiché, pour que vous puissiez le vérifier
Tous les guides 10
5 on dimensionnement · 2 on coût · 2 on pratique · 1 on paiement
-
Dimensionnement · 9 min
Combien de VRAM un modèle utilise réellement
L’arithmétique derrière « est-ce que ça tient » : poids, cache clef/valeur, et les deux endroits où une règle empirique se trompe d’un facteur trois.
Lire le guide -
Dimensionnement · 7 min
NVLink ou PCIe : lequel exige votre tâche
Quand le lien entre les cartes détermine votre débit, quand cela ne change rien, et comment savoir dans quel cas vous êtes avant de payer pour le mauvais nœud.
Lire le guide -
Dimensionnement · 9 min
Choisir une carte pour les modèles d’image et de vidéo
Ce que FLUX, SDXL, SD 3.5 et Wan 2.1 demandent en VRAM, la carte du catalogue qui convient à chacun, et pourquoi la moins chère qui tient est rarement le bon choix.
Lire le guide -
Dimensionnement · 10 min
Choisir un format de quantification
Ce que coûtent AWQ, GPTQ, GGUF et FP8 en mémoire, vitesse et qualité — et pourquoi le format aux poids les plus légers donne rarement le modèle le plus petit.
Lire le guide -
Dimensionnement · 10 min
Faire tourner un modèle à mélange d’experts
Le nombre total de paramètres décide de la machine, les actifs de la vitesse. Ce qu’il faut en VRAM pour DeepSeek V3 et Qwen 3 235B, et quel nœud louer.
Lire le guide -
Coût · 6 min
Quand la location mensuelle l’emporte sur l’horaire
Le seuil de rentabilité sur des chiffres réels, les trois coûts qu’un prix horaire cache jusqu’à la facture, et le piège du temps mort qui triple une estimation.
Lire le guide -
Coût · 9 min
L’auto-hébergement contre une API facturée au token
Le seuil de rentabilité entre payer une API au token et louer un GPU, calculé sur nos propres prix et débit — et les quatre points que l’arithmétique laisse de côté.
Lire le guide -
Pratique · 11 min
Servir Llama 3.3 70B sur un nœud
D’une machine livrée à un point de terminaison compatible OpenAI, avec les options qui comptent et les deux qui divisent silencieusement votre débit par deux.
Lire le guide -
Pratique · 10 min
Fine-tuning d’un modèle 70B sur une seule carte
QLoRA sur un seul GPU de 48 GB : ce qui tient, ce que cela coûte pour un mois, et pourquoi le fine-tuning complet est une tout autre catégorie de machine.
Lire le guide -
Paiement · 8 min
Payer un serveur en crypto
Ce qui se passe entre le clic sur payer et l’obtention du root, quelle monnaie choisir, et les quatre erreurs qui font perdre de l’argent sur un premier paiement.
Lire le guide
Ten questions déterminent quelle machine vous devriez louer.
Nous préférons écrire ten articles qui répondent à une vraie question plutôt que soixante qui se classent pour un mot-clé. Chaque guide ci-dessus existe parce que c’est une question qu’on nous pose avant une commande, et chacun est rédigé face aux cartes de notre propre catalogue — les chiffres qu’ils contiennent sont des chiffres tirés de machines que nous exploitons.
Lorsqu’un guide montre une formule, c’est la même formule que celle utilisée par le configurateur pour vous dire si un modèle tient. C’est voulu : vous devez pouvoir vérifier notre calcul plutôt que de faire confiance à la coche verte sur parole.
Droit au but
Si vous savez déjà ce qu’il vous faut
Chaque guide finit au même endroit.
Une machine que vous pouvez louer au mois, payer en crypto, et ouvrir sans prouver qui vous êtes.