ガイド。
どのマシンを借りるべきかを決める問いについて、長めの記事で扱います。実際に運用しているハードウェアをもとに、計算過程も示します。
- 当社が運用する実機に基づいて執筆
- 貼り付けるだけで動くコマンド、疑似コードではありません
- 計算式を提示しているので、ご自身で確認いただけます
全10件のガイド
5 on サイジング · 2 on コスト · 2 on 実践 · 1 on 支払い
-
サイジング · 9分
モデルが実際に必要とするVRAM容量
「モデルが収まるか」を決める計算の中身:重み、KVキャッシュ、そして経験則が3倍もずれてしまう2つの落とし穴を解説します。
ガイドを読む -
サイジング · 7分
NVLinkかPCIeか:ジョブに必要なのはどちらか
カード間の接続がスループットを左右する場合、まったく影響しない場合、そして間違ったノードに支払う前にどちらの状況かを見分ける方法。
ガイドを読む -
サイジング · 9分
画像・動画モデル向けのカード選び
FLUX、SDXL、SD 3.5、Wan 2.1がそれぞれ必要とするVRAM、カタログ内でそれを収められるカード、そして収まる中で最も安いカードが借りるべき最適解とは限らない理由。
ガイドを読む -
サイジング · 10分
量子化フォーマットの選び方
AWQ、GPTQ、GGUF、FP8それぞれがメモリ、速度、品質の面で払う代償。そして、重みが最も小さい形式が、最も小さいモデルになるとは限らない理由。
ガイドを読む -
サイジング · 10分
混合エキスパートモデルを運用する
総パラメータ数がマシンを決め、アクティブパラメータ数が速度を決めます。DeepSeek V3とQwen 3 235Bが必要とするVRAM容量と、借りるべきノードを解説します。
ガイドを読む -
コスト · 6分
月額レンタルが時間貸しに勝つのはどんな時か
実際の数字で算出した損益分岐点、時間単価が請求書が来るまで隠している3つのコスト、そして見積もりを3倍に膨らませるアイドル時間の落とし穴。
ガイドを読む -
コスト · 9分
セルフホスティングとトークン課金APIの比較
トークン課金APIとGPUレンタルの損益分岐点を、自社の価格とスループットで算出。そして、その計算が見落としている4つの要素。
ガイドを読む -
実践 · 11分
Llama 3.3 70Bを1ノードで提供する
納品されたマシンから、OpenAI互換エンドポイントまで。重要なフラグと、気づかぬうちにスループットを半減させる2つのフラグを解説します。
ガイドを読む -
実践 · 10分
1枚のカードで70Bモデルをファインチューニング
48GB GPUを1枚使ったQLoRA:何が収まるか、月額でいくらかかるか、そしてフルファインチューニングがなぜまったく別次元のマシンを必要とするのかを解説します。
ガイドを読む -
支払い · 8分
サーバー代金を暗号資産で支払う
支払いをクリックしてからrootを取得するまでに実際に起こること、どのコインを選ぶべきか、そして初回の支払いで損をする4つの間違い。
ガイドを読む
どのマシンを借りるべきかは、Tenつの問いで決まります。
検索語で上位表示される60本の記事より、実際の疑問に答えるten本の記事を書くほうを選びます。上記の各ガイドは、注文前に実際に寄せられる質問だからこそ存在しており、それぞれ当社自身のカタログにあるカードをもとに書かれています。掲載されている数値は、当社が運用しているマシンから得た数値です。
ガイドに計算式が示されている場合、それはコンフィギュレーターがモデルが収まるかどうかを判定するのに使うのと同じ式です。これは意図的なものです: 緑色のチェックマークを鵜呑みにするのではなく、当社の計算をご自身で検証できるようにするためです。
単刀直入に
必要なものがすでに分かっている場合