- ホーム
- 専有エンドポイント
8 GPU最小単位(1ノード)
2.3 TBノードあたりGPUメモリ
3–4ヶ月予約から提供まで(最短)
含まれるもの。
- 単一テナントのノード — 物理ノードはお客様のアカウントに専有で割り当てます。GPUは整数枚単位で、お客様間で分割することはありません。
- モデルの運用 — 重みの配置、推論サーバー、バッチング、量子化の選択、バージョン管理まで当社が行います。
- 自社モデルの持ち込み — お持ちの重み、または継続事前学習・微調整済みのモデルを持ち込めます。重みはお客様のものです。
- 専用のエンドポイント — OpenAI互換のURLとAPIキー。レート制限はお客様の予約容量で決まり、他社の負荷に影響されません。
- 内容検査なし — 単一テナントのハードウェア層では、コンプライアンス監視はメタデータ層に限ります。プロンプトと生成結果は検査しません。
- 同じSLA — 割当単位あたり月間可用率99.5%以上。24×7の監視と一次対応。
課金と契約。
課金単位
予約GPU
予約したGPU数に対して月額でお支払いいただきます。使用率にかかわらず容量は確保されます。円建て、月次前払い。
期間
1年から
専有クラスターより短い期間から始められます。期間が長いほど条件は良くなります。
拡張
ノード単位で増減
ノード単位で追加できます。追加分は提供窓口の空き状況に従います。専有クラスターへの移行も同じ契約の枠内で扱えます。
料金は、提供時期、契約期間、予約GPU数、予約比率で決まります。与件確認を通過したお客様に割当条件をご提示します。