Руководства.
Длинные материалы о вопросах, которые определяют, какую машину арендовать, — написанные на основе оборудования, которое мы реально эксплуатируем, с показанной арифметикой.
- Написано на основе оборудования, которое мы сами эксплуатируем
- Команды, которые можно вставить, а не псевдокод
- Арифметика показана — вы можете её проверить
Все 10 руководств
5 on Расчёт · 2 on Стоимость · 2 on Практика · 1 on Оплата
-
Расчёт · 9 мин
Сколько VRAM реально нужно модели
Арифметика вопроса «поместится ли модель»: веса, KV-кэш и два места, где эмпирическое правило ошибается сразу втрое.
Читать руководство -
Расчёт · 7 мин
NVLink или PCIe: что нужно вашей задаче
Когда связь между картами определяет пропускную способность, когда она ничего не меняет и как понять, какой у вас случай, прежде чем платить за не тот узел.
Читать руководство -
Расчёт · 9 мин
Выбор карты для моделей изображений и видео
Сколько VRAM нужно FLUX, SDXL, SD 3.5 и Wan 2.1, какая карта каталога держит каждую и почему дешёвая подходящая карта редко оказывается лучшим выбором.
Читать руководство -
Расчёт · 10 мин
Выбор формата квантования
Во что обходятся AWQ, GPTQ, GGUF и FP8 по памяти, скорости и качеству — и почему формат с самыми лёгкими весами редко даёт самую маленькую модель.
Читать руководство -
Расчёт · 10 мин
Запуск модели на основе смеси экспертов
Общее число параметров определяет машину, активные параметры — скорость. Сколько VRAM нужно DeepSeek V3 и Qwen 3 235B, и какой узел для них арендовать.
Читать руководство -
Стоимость · 6 мин
Когда помесячная аренда выгоднее почасовой
Точка безубыточности на реальных цифрах, три статьи расходов, которые почасовая цена скрывает до счёта, и ловушка простоя, утраивающая оценку.
Читать руководство -
Стоимость · 9 мин
Self-hosting против API с оплатой за токен
Точка безубыточности между оплатой API за токен и арендой GPU на наших ценах и пропускной способности — и четыре момента, которые арифметика не учитывает.
Читать руководство -
Практика · 11 мин
Llama 3.3 70B на одном узле
От доставленной машины до OpenAI-совместимого эндпоинта: флаги, которые действительно важны, и два флага, которые незаметно вдвое снижают пропускную способность.
Читать руководство -
Практика · 10 мин
Файнтюнинг модели 70B на одной карте
QLoRA на одной GPU с 48 GB: что помещается, сколько это стоит в месяц и почему полный файнтюнинг — машина совсем другого уровня.
Читать руководство -
Оплата · 8 мин
Оплата сервера криптовалютой
Что на самом деле происходит между нажатием «оплатить» и получением root, какую монету выбрать и четыре ошибки, которые теряют деньги при первом платеже.
Читать руководство
Ten вопросов определяют, какую машину вам стоит арендовать.
Мы предпочитаем написать ten материалов, отвечающих на реальный вопрос, чем шестьдесят, ранжирующихся по поисковому запросу. Каждое руководство выше существует потому, что это вопрос, который нам задают перед заказом, и каждое написано на основе карт из нашего собственного каталога — цифры в них взяты с машин, которые мы сами эксплуатируем.
Там, где руководство приводит формулу, это та же формула, которую использует конфигуратор, чтобы определить, поместится ли модель. Это осознанный выбор: вы должны иметь возможность проверить нашу арифметику, а не принимать зелёную галочку на веру.
Сразу к сути
Если вы уже знаете, что вам нужно
Каждое руководство приходит к одному и тому же месту.
Машина, которую можно арендовать помесячно, оплатить криптовалютой и открыть, не подтверждая, кто вы.