1. ホーム
  2. 専有エンドポイント
専有エンドポイント

あなた専用のノードで、
当社がモデルを回す。

単一テナントのハードウェア上に、お客様専用の推論エンドポイントを構築し、当社が運用します。専有クラスターのような分離を得ながら、スタックの運用は当社に任せられる中間の形態です。

8 GPU最小単位(1ノード)
2.3 TBノードあたりGPUメモリ
3–4ヶ月予約から提供まで(最短)

含まれるもの。

  • 単一テナントのノード — 物理ノードはお客様のアカウントに専有で割り当てます。GPUは整数枚単位で、お客様間で分割することはありません。
  • モデルの運用 — 重みの配置、推論サーバー、バッチング、量子化の選択、バージョン管理まで当社が行います。
  • 自社モデルの持ち込み — お持ちの重み、または継続事前学習・微調整済みのモデルを持ち込めます。重みはお客様のものです。
  • 専用のエンドポイント — OpenAI互換のURLとAPIキー。レート制限はお客様の予約容量で決まり、他社の負荷に影響されません。
  • 内容検査なし — 単一テナントのハードウェア層では、コンプライアンス監視はメタデータ層に限ります。プロンプトと生成結果は検査しません。
  • 同じSLA — 割当単位あたり月間可用率99.5%以上。24×7の監視と一次対応。

課金と契約。

課金単位

予約GPU

予約したGPU数に対して月額でお支払いいただきます。使用率にかかわらず容量は確保されます。円建て、月次前払い。

期間

1年から

専有クラスターより短い期間から始められます。期間が長いほど条件は良くなります。

拡張

ノード単位で増減

ノード単位で追加できます。追加分は提供窓口の空き状況に従います。専有クラスターへの移行も同じ契約の枠内で扱えます。

料金は、提供時期、契約期間、予約GPU数、予約比率で決まります。与件確認を通過したお客様に割当条件をご提示します。

次のステップ

必要なものをお聞かせください。48時間以内にご返信します。

与件確認を通過したご相談には、48時間以内に技術ミーティングの候補日をご提示し、ミーティング後に割当条件をお送りします。いただいた情報はNDAのもとで取り扱います。