Dokümantasyon

# Ödeme onayından ilk tokene.

Teslimat mesajınızda neyin geldiği, halihazırda neyin kurulu olduğu ve ilk saat için tam olarak hangi komutların çalıştırılacağı. Aşağıdakilerin tümü, yeni teslim edilmiş bir makinede root olarak çalıştırılır.

- 5 dakikanın altında ödemeden aşağıdaki mesaja kadar
- 10 sizin için yazdırabileceğiniz imajlar
- root sudo yok, jump host yok, konsol yok
- 22 teslimatta açık olan tek port

## Gelenler

Ödeme onaylandıktan 5 dakikanın altında sonra tek bir mesaj. İhtiyacınız olan her şeyi içerir, tıklayıp geçmeniz gereken hiçbir şeyi içermez.

SSH Adres, port 22 ve root parolanız Parola, yapılandırıcıda **sizin** belirlediğiniz paroladır. Onu asla biz oluşturmayız, sonrasında asla açık haliyle görmeyiz ve sizin için sıfırlayamayız.

Ağ IPv4 adresi, ağ geçidi ve IPv6 /64'ünüz Makinede zaten yapılandırılmıştır. Blok, üzerinde ek adresler planlayabilmeniz için listelenir.

IPMI Ayrı bir adres ve kendi kimlik bilgileri Bir yönetim VLAN'ında. İşletim sistemi erişilemez olduğunda bile erişilebilen uzaktan güç, seri konsol ve sanal medya.

Donanım Düğümünüzdeki kesin CPU, kart ve disk modelleri Doğruladığınız makinenin size satılan makine olduğunu kanıtlayabilmeniz için her kartın modeli ve seri numarası.

**Root parolanızı kurtaramayız.** Onu siz belirlersiniz ve yalnızca imaja yazılana kadar saklanır. Kaybederseniz geri dönüş yolu IPMI'dir: kurtarma imajını sanal medyadan önyükleyip parolayı kendiniz sıfırlayın. Bu, kimlik bilgilerinizi bizim tutmamamızın bir özelliğidir, ama gerçek bir zahmet de teşkil eder — şimdiden bir parola yöneticisine kaydedin.

## İlk bağlantı

Kabul edilecek bir şey yok, kurulacak bir ajan yok. Yapılandırıcıda bize bir genel anahtar verdiyseniz o zaten `/root/.ssh/authorized_keys` içindedir.

Makineniz, ilk oturum açma

```
$ ssh root@203.0.113.42
# Sonra, her şeyden önce — teslimat mesajındaki parmak izi
# burada yazdırılanla eşleşmelidir:
$ ssh-keygen -lf /etc/ssh/ssh_host_ed25519_key.pub
```

Bir anahtar gönderdiyseniz parolayı kapatın. Tek bir komut yeter ve tahmin edilebilecek tek kimlik bilgisini ortadan kaldırır.

Yalnızca anahtarla erişim

```
# ÖNCE anahtarınızın çalıştığını doğrulayın — burada hâlâ oturum açıkken, ikinci bir terminalde.
$ sed -i 's/^#\?PasswordAuthentication.*/PasswordAuthentication no/' /etc/ssh/sshd_config
$ systemctl reload ssh
```

## Donanımı doğrulayın

Bunu ilk on dakika içinde yapın. Görmediğiniz bir makineniz var ve bir donanım arızasındaki SLA saati, bize bildirdiğiniz anda başlar.

Kartlar, bellek ve aralarındaki bağlantı

```
$ nvidia-smi --query-gpu=index,name,serial,memory.total,pcie.link.gen.current --format=csv
index, name, serial, memory.total [MiB], pcie.link.gen.current
0, NVIDIA H100 80GB HBM3, 1650123456789, 81559 MiB, 5
1, NVIDIA H100 80GB HBM3, 1650123456790, 81559 MiB, 5

# Çoklu GPU'lu bir düğümde, topolojinin ödediğinizle eşleştiğini kontrol edin.
# NV# NVLink anlamına gelir; PIX/PHB/SYS ise trafiğin PCIe üzerinden gittiği anlamına gelir.
$ nvidia-smi topo -m
```

Boost değeri değil, sürekli işlem hacmi

```
# Her kartı yük altında iki dakika tutun ve hangi saat hızında sabitlendiğini izleyin.
$ nvidia-smi -q -d PERFORMANCE,TEMPERATURE,CLOCK | grep -E 'Slowdown|SW Power|Graphics *:'

# Diskler: sayıyı ve modeli teslimat mesajıyla karşılaştırarak doğrulayın.
$ lsblk -d -o NAME,MODEL,SIZE,ROTA
$ nvme list
```

**Herhangi bir şey uyuşmuyorsa, hemen belirtin.** Yanlış bir kart, eksik bir disk, Gen5 yerine Gen3'te çalışan bir bağlantı — ilk gün içinde bize bildirin, tartışmasız düğümü değiştirelim veya süreyi iade edelim. Bir aylık kullanımdan sonra aynı bildirim, bir teslimat anlaşmazlığı değil bir destek talebidir ve bu, ikimiz için de daha yavaştır.

## Önceden kurulanlar

Yapılandırıcıda bir işletim sistemi seçin, isterseniz üzerine bir yığın da ekleyin. Aşağıdakilerin tümü teslimattan önce yazılır, ilk önyüklemede indirilmez.

**Önceden kurulu imajlar, içerdikleri ve ihtiyaç duydukları minimum kart**

| İmaj | Kullanım amacı | Minimum VRAM | İşletim Sistemi |
|---|---|---|---|
| vLLM 0.11 OpenAI uyumlu sunucu, sürekli batching | Büyük dil modellerini sunma | 24 GB | Linux |
| SGLang 0.5 Yapılandırılmış çözümleme, RadixAttention önbelleği | Büyük dil modellerini sunma | 24 GB | Linux |
| Text Generation Inference Hugging Face sunum yığını | Büyük dil modellerini sunma | 24 GB | Linux |
| Ollama 0.12 Tek komut, nicemlenmiş modeller dahil | Büyük dil modellerini sunma | 8 GB | Linux |
| Axolotl 0.8 LoRA ve QLoRA fine-tuning | Eğitim ve fine-tuning | 24 GB | Linux |
| PyTorch 2.9 · CUDA 12.8 Temel framework, cuDNN 9, NCCL | Eğitim ve fine-tuning | 8 GB | Linux |
| ComfyUI SDXL, Flux, SD 3.5, video düğümleri | Görüntü ve video üretimi | 12 GB | Linux |
| JupyterLab · CUDA Sade bir CUDA yığınında notebooklar | Eğitim ve fine-tuning | 8 GB | Linux |
| Blender 4.5 Cycles GPU render, headless | 3D render | 8 GB | Linux veya Windows |
| Kendi Docker imajınız Herhangi bir genel veya özel registry | Kendi getirdiğiniz her şey | Minimum yok | Linux |

Hangi yazılım yığınını seçerseniz seçin, her Linux imajında zaten çalışan bir NVIDIA sürücüsü, CUDA, cuDNN ve NCCL bulunur. Hepsini değiştirmekte özgürsünüz — root sizindir ve yeniden kurulum hiçbir ücrete tabi değildir ve hız sınırlaması yoktur.

## Konteynerler ve CUDA

Docker ve NVIDIA container toolkit kurulu ve yapılandırılmış durumdadır. Aşağıdaki kontrol otuz saniyenizi almaya değer, çünkü kartları göremeyen bir konteyner çok daha sonra kafa karıştırıcı bir şekilde başarısız olur.

Bir konteyner kartları görüyor mu?

```
$ docker run --rm --gpus all nvidia/cuda:12.8.0-base-ubuntu24.04 nvidia-smi

# Çoklu GPU işleri de paylaşımlı bellek ve IPC gerektirir; varsayılan sınırlar bunu bozar.
# Bu üç bayrak genellikle sessiz bir NCCL takılmasının nedenidir:
$ docker run --rm --gpus all --ipc=host --shm-size=16g --ulimit memlock=-1 …
```

## Bir modeli sunma

Teslim edilen bir makineden OpenAI uyumlu bir uç noktaya en kısa yararlı yol. Kendi modelinizi kullanın; önemli olan bayraklardır.

Tek kartta vLLM

```
$ docker run -d --name vllm --gpus all --ipc=host -p 8000:8000 \
    vllm/vllm-openai:latest \
--model meta-llama/Llama-3.3-70B-Instruct \
    --max-model-len 8192 \
    --gpu-memory-utilization 0.92

# Çoklu GPU'lu bir düğümde, kutudaki her kart arasında paylaştırın:
$ … --tensor-parallel-size 4

# Sonra, kendi makinenizden:
$ curl http://203.0.113.42:8000/v1/models
```

**Bu uç noktada kimlik doğrulama bulunmaz.** Herkese açık bir adreste yayımlandığında açık bir çıkarım sunucusu haline gelir ve birkaç saat içinde bulunur. Çalışır durumda bırakmadan önce onu localhost'a bağlayıp bir SSH tüneli üzerinden erişin, ya da bir sonraki bölümdeki güvenlik duvarı kurallarının arkasına koyun.

Belirli bir modelin belirli bir makineye sığıp sığmadığı bir görüş değil, aritmetiktir — ağırlıklar, artı bağlam uzunluğuyla büyüyen bir KV önbelleği. Yapılandırıcı, ödemeden önce her yapılandırma için bu aritmetiği yapar ve [VRAM boyutlandırma rehberi](https://gpuserver.io/tr/guides/vram-sizing) formülü gösterir, böylece bizimkini kontrol edebilirsiniz.

## Diskler ve depolama

Sistem biriminin ötesindeki diskler ham olarak teslim edilir. Herhangi bir RAID seviyesi dayatmayız, çünkü doğru seçim, kaybedemeyeceğiniz kontrol noktalarını mı yoksa bir saatte yeniden indirebileceğiniz bir veri kümesini mi tuttuğunuza bağlıdır.

Yedek NVMe aygıtları arasında şeritlenmiş bir geçici birim

```
# Önce neyin kullanılmadığını kontrol edin — bu, adı geçen aygıtlardaki verileri yok eder.
$ lsblk

$ mdadm --create /dev/md0 --level=0 --raid-devices=2 /dev/nvme1n1 /dev/nvme2n1
$ mkfs.ext4 -E lazy_itable_init=0,lazy_journal_init=0 /dev/md0
$ mkdir -p /scratch && mount /dev/md0 /scratch
$ echo '/dev/md0 /scratch ext4 defaults,noatime 0 2' >> /etc/fstab
```

Ek NVMe, arşiv HDD ve makine dışı anlık görüntüler, yapılandırıcıda veya sonradan eklenen aylık seçeneklerdir. Yerel diskler tarafımızca yedeklenmez ve hiçbir zaman yedeklenmeyecektir — aşağıdaki [anlık görüntülere](https://gpuserver.io/tr/docs#snapshots) bakın.

## Güvenlik duvarı ve portlar

Kendi makinenizin engellediği dışında gelen her şey açıktır: önünüzde bir ağ filtresi yoktur, bu bilinçli bir tercihtir ve sorumluluğu buraya bırakır. Giden port 25 tek istisnadır; siz istemedikçe üst kademede kapalı tutulur.

Asgari bir kural kümesi: her yerden SSH, bir adresten bir hizmet

```
$ ufw default deny incoming
$ ufw default allow outgoing
$ ufw allow 22/tcp
$ ufw allow from 198.51.100.7 to any port 8000 proto tcp
$ ufw --force enable

# Bir portu hiç açmamaktan daha güvenli: hizmeti localhost üzerinde tutun
# ve kendi makinenizden ona tünel açın.
$ ssh -N -L 8000:127.0.0.1:8000 root@203.0.113.42
```

## IPMI ve yeniden kurulum

Bant dışı erişim her makinede, kendi adresinde bulunur. Sabahın üçünde, kimseye sormadan, kendinizi dışarıda bıraktığınız bir kutuyu kurtarmanızı sağlayan yol budur.

### Güç

Sert güç döngüsü, düzgün kapatma ve kasa güç durumu — işletim sisteminin yanıt verip vermediğinden bağımsız olarak.

### Seri ve KVM konsolu

Makinenin bir monitörde göstereceği ekran; önyükleyici ve çekirdek paniği dahil. Bozuk bir `fstab`'ı burada onarırsınız.

### Sanal medya

Ağ üzerinden herhangi bir ISO'yu bağlayıp önyükleyin. Buna bir kurtarma imajı da dahildir, sunmadığımız bir işletim sistemi de.

Sunduğumuz imajlardan herhangi birine temiz bir yeniden kurulum bizden talep edilir ve orijinal teslimatla yaklaşık aynı süreyi alır. Hiçbir ücrete tabi değildir, ne sıklıkla yapılacağına dair bir sınır yoktur ve makine adreslerini korur. Disklerdeki her şey bu işlemle yok edilir — bir yeniden kurulumun amacı budur ve geri alma yoktur.

## Anlık Görüntüler

İsteğe bağlı, aylık, makinenin dışında. Onları satın almazsanız, verilerinizin bir kopyası kendi disklerinizden başka hiçbir yerde bulunmaz — bu, bir GPU'da çalışan işlerin çoğu için doğru varsayılandır, kalanı için ise bir felakettir.

Yakalananlar Blok düzeyinde, her gece Makine çalışırken alınan sistem biriminin tamamı. Kendi oluşturduğunuz scratch dizileri yalnızca belirtirseniz dahil edilir.

Bulunduğu yer Başka bir bina, aynı ülke Asla koruduğu makinenin üzerinde değil. Arızalanan bir kasa kendi anlık görüntülerini de birlikte götürmez.

Saklama süresi 30 gün, kayan Ardından üzerine yazılır. Uzun vadeli bir arşiv yoktur ve sonradan talep etmenin bir yolu yoktur.

Sürenin sonunda Makineyle birlikte silinir Anlık görüntüler, ait oldukları sunucudan daha uzun ömürlü değildir. İhtiyacınız olanı süre kapanmadan önce dışarı alın.

## Süreyi sonlandırma

Aylık bir süre, ödenen ayın sonunda biter; bildirim süresi ve iptal ücreti yoktur. Bundan sonra olanlar geri alınamaz, bu yüzden bir dipnotta değil burada açıkça yazılıdır.

1. **Hiçbir şey kendiliğinden yenilenmez.** Kayıtlı bir kart ve otomatik ödeme talimatı yoktur — bir süre yalnızca bir sonrakini ödediğiniz için devam eder.
2. **Genel port, sürenin bittiği anda kesilir.** Makine, bir ek günün sonunda değil, anında erişilemez hale gelir.
3. **Diskler bir saat içinde silinir.** Önce kriptografik silme, ardından tam üzerine yazma. Verilerinizin bir yerde hâlâ var olduğu bir zaman aralığı yoktur.
4. **Anlık görüntüler de onunla birlikte gider.** Satın aldıysanız, aynı işlemde silinirler.
5. **Adres havuza geri döner.** Bir bekleme süresinin ardından, ve yalnızca temiz olduğunda.

**Verilerinizi son günden önce kopyalayın, o gün değil.** Sonradan hiçbir şeyi geri getiremeyiz — ne ücret karşılığında, ne bir iyilik olarak. Silme işlemi zaten çalıştı; bir sonraki kiracıya temiz bir makine garanti edebilmemizin nedeni de bunun kimsenin onayı olmadan çalışmasıdır.

## Yukarıdakilerin tümü katalogdaki her makinede çalışır.

IPMI'nin, yeniden kurulumların veya sayaçsız bant genişliğinin ekstra ücrete tabi olduğu bir seviye yoktur. Bir kart seçin, bir yer seçin, bu sayfanın geri kalanı geçerlidir.

[Katalogda göz atın](https://gpuserver.io/tr/#catalog) [Rehberleri okuyun](https://gpuserver.io/tr/guides)

## İlgili sayfalar

- [Rehberler Sekiz pratik rehber: VRAM boyutlandırma, NVLink/PCIe, görsel ve video modelleri, aylık/saatlik, kendi barındırma/API, Llama 70B sunumu, QLoRA.](https://gpuserver.io/tr/guides)
- [Donanım politikası İşlettiğimiz on iki NVIDIA GPU, bir düğüm satılmadan önceki 72 saatlik burn-in, dört saatlik değişim hedefi ve disklerin kiracılar arasında nasıl silindiği.](https://gpuserver.io/tr/hardware)
- [Ağ 25 Gbit/s'e kadar sayaçsız portlar, site başına iki operatör ve bir IX, sürekli DDoS filtreleme, yönlendirilen IPv6 — ve baştan belirtilen, sunmadığımız dört şey.](https://gpuserver.io/tr/network)
- [Hakkımızda gpuserver.io'yu kimin işlettiği, donanımı yeniden satmak yerine neden satın aldığımız ve esnetmediğimiz dört kural — bize satış kaybettirenler dahil.](https://gpuserver.io/tr/about)

---

Kaynak: https://gpuserver.io/tr/docs/. Bu dosya, web sitesiyle aynı verilerden üretilir; buradaki bir rakam bir sayfadan farklıysa, o sayfa esas alınır ve bu dosya güncel değildir — asıl kaynak https://gpuserver.io/ adresidir.
