- ホーム
- AI基盤
三つの利用形態。ひとつの基盤。
同じ電源、同じデータセンター、同じ運用体制の上に、粒度の違う三つの入口を置いています。APIキー1本から始めて、専有エンドポイント、専有クラスターへ移ることができます。容量は提供窓口ごとに割り当て、容量予約で確定します。
マネージドAPI
OpenAI互換のエンドポイント。トークン課金、APIキー1本から。モデルは能力カテゴリで提供します。
専有エンドポイント
単一テナントのノード上で、お客様専用の推論エンドポイントを当社が運用します。予約GPU課金、1ノード(8×B300)から。
専有クラスター
単一テナントのベアメタル。お客様が自らスタックを動かします。32ノード(256 GPU)から256ノード(2,048 GPU)まで。
誰がスタックを動かすか、で決まります。
| マネージドAPI | 専有エンドポイント | 専有クラスター | |
|---|---|---|---|
| スタックを動かすのは | 当社 | 当社 | お客様 |
| ハードウェアの共有 | 共有容量 | 単一テナント | 単一テナント・ベアメタル |
| 課金 | トークン | 予約GPU | コミット容量 |
| 最小単位 | APIキー1本 | 1ノード(8 GPU) | 32ノード(256 GPU) |
| 提供時期 | 2027年 Q2 | 最短 約3〜4ヶ月 | 標準 約6ヶ月 |
| 向いている用途 | 検証、社内ツール、変動する推論 | 定常的な推論、自社モデルの提供 | 学習、長期の大規模推論 |
32ノード未満で専有ハードウェアが必要な場合は、専有エンドポイントでノード単位のご提供が可能です。ご相談ください。
NVIDIA B300 標準ノード。
すべての形態が同じ標準ノードの上で動きます。ノードは8基のB300を積んだ10Uの空冷筐体で、ノードあたりの参考消費電力は約15 kWです。
ネクステアAI B300 標準ノードと初号クラスター
| プラットフォーム | HGX B300 NVL16 · 8-GPU node · 10U air-cooled |
|---|---|
| GPU | 8 × NVIDIA B300 · 288 GB HBM3e each · ~2.3 TB / node |
| CPU・メモリ | 2 × Intel Xeon 6 · 3 TB DDR5-6400 |
| ローカルストレージ | 2 × 960 GB M.2 (OS) · 8 × 3.84 TB NVMe |
| ネットワーク | 8 × ConnectX-8 800G (integrated) · BlueField-3 DPU |
| クラスター・ファブリック | 32 nodes · 256 GPUs · Quantum-X800 InfiniBand · rail-optimized · 1:1 |
| 共有ストレージ | 高性能共有ストレージ(専有) |
| 電力 | ノードあたり約 15 kW(参考値) |
| 設置 | 日本国内 · 単一テナント |
| 運用・SLA | 24×7 マネージド · 月間可用率 99.5% 以上(割当単位あたり) |
| 契約 | 複数年コミット · 標準5年(3年も可) |
標準ノード構成です。最終的なBOMは割当条件書に添付します。後続世代(GB300 · Vera Rubin)は後続の提供窓口で割り当てます。
クラスターは4段階。
いずれの段階でも 1:1 non-blocking の rail-optimized ファブリックで構成します。GPUメモリと消費電力はノードあたりの参考値からの概算で、確定値は割当条件書に記載します。
| 規模 | GPU | GPUメモリ合計 | IT負荷(概算) |
|---|---|---|---|
| 32 ノード | 256 | ~74 TB | ~0.5 MW |
| 64 ノード | 512 | ~147 TB | ~1.0 MW |
| 128 ノード | 1,024 | ~295 TB | ~1.9 MW |
| 256 ノード | 2,048 | ~590 TB | ~3.8 MW |
初回提供窓口(2027年 Q2)は32ノード・256 GPUです。それ以上の規模は後続の窓口で割り当てます。
世代と提供窓口。
NVIDIA B300
HGX B300 NVL16、8 GPUのノード単位で割り当て。空冷、封じ込め通路。
NVIDIA GB300
ラック単位の割り当て、直接液冷。対応サイトの条件が整い次第。
NVIDIA Vera Rubin
ラック単位の割り当て、直接液冷。
カスタム構成
お客様の設計に合わせた構成。技術ミーティングでご相談ください。
世代ごとに割当の単位が変わります(B300はノード、ラックスケール世代はラック)。ページ上の容量はすべてGPU数で表記しています。前世代の1ラックあたりGPU数と電力密度は契約時に確定します。