プレビルドのGPUサーバーとAIワークステーションをMillionMinerでご購入ください。仕様に合わせて組み立て、負荷試験を実施し、運用開始の状態で出荷します。取り扱い可能な構成は、単一GPUのRTX 5090ワークステーションから、128 PCIe 5.0レーンを備えたデュアルGPUのThreadripper PROシステム、クアッドおよび8-GPUノードまであり、8-GPU RTX 5090ノードは約838 TFLOPSのFP32性能を発揮します。…
すべてのサーバーは保証付きで新規に出荷され、無料の世界中DDPサービスもご提供しております。したがって、チェックアウト時の価格は最終的な着地点コストとなり、出荷前に安定性が検証されています。ご自身で運用されるか、当社の米国ホスティングにリモート管理でデプロイしてください。GPUサーバーとAIワークステーションは下記より購入可能です。
Supermicro SuperServer SYS-741GE-TNRT 4-GPU H100 AIサーバー
On request
—
On request
Supermicro AS-4124GO-NART+ 8x A100 HGX AIサーバー
On request
—
On request
NVIDIA DGX A100 Deep Learning System(8x A100、640GB)
On request
—
On request
Exeton Quasar 640X 8x A100 AIサーバー(640GB NVLink)
On request
—
On request
Lenovo NVIDIA HGX H200 141GB 700W 8-GPUサーバー
On request
—
On request
Supermicro HGX H800 SuperServer SYS-821GE-TNHR
On request
—
On request
GIGABYTE G893-ZD1-AAX5 HGX B200 8-GPUサーバー
On request
—
On request
Gigabyte G492-ZD0 HGX A100 8-GPUサーバー、Dual AMD EPYC 7742、4U(中古)
On request
—
On request
Supermicro GPU A+サーバー AS-8126GS-NB3RT NVIDIA HGX B300 NVL8
On request
—
On request
ASUS XA NB3I-E12 NVIDIA HGX B300 NVL8 GPUサーバー
On request
—
On request
Supermicro SYS-111C-NR-G1 1U Rackmount X13 UP Gold Series CloudDC SuperServer
In stock
—
$5,700.00
Supermicro SYS-521C-NR-G1 2UラックマウントX13 UPゴールドシリーズCloudDCスーパサーバー
In stock
—
$5,700.00
工場用グレードのシステム
設定済み、テスト済み、ベンチマーク検証済み
貨物物流
世界中の保険付きパレットおよび航空輸送
暗号通貨対応
BTC、ETH、USDT などでお支払いください
専門サポート
AIインフラストラクチャーの設計者が待機しています
AIサーバーは単なるGPU搭載のPCではありません。真剣にAIインフラストラクチャを構築するには、GPU間通信に高帯域幅のNVSwitchネットワークを備えた目的特化型プラットフォーム、高容量のDDR5メモリ、各GPUに十分なPCIeレーンを持つエンタープライズグレードのCPU、高速チェックポイントI/O用のNVMeストレージ、そしてラックユニットあたり10kWを超える電力供給システムが必要です。私たちは、研究所向けの2-GPUタワーシステムからNVIDIA HGX H100/H200 8-GPUノード、さらには新しいGB200 NVL72ラック規模のアーキテクチャまで、即時運用可能な完全なAIサーバープラットフォームを提供しています。
DGX H100 GPUの台数
8 × H100 SXM5
合計640 GBのHBM2eをNVSwitch経由で搭載
NVL72 GPUの数
72 GPUs
GB200は1つのラックに収まり、1つのロジカルユニットです
DGX H100 AI性能。
32 PFLOPS
FP8疎 sparse - 8× H100の組み合わせ
HGX H200 メモリ
1.1 TB HBM3e
8 × H200 SXM5 — 合計帯域幅 38.4 TB/s
8 × H100 SXM5, 640 GB
箱型完全AIスーパーコンピュータ。NVSwitchフルメッシュでGPUあたり900 GB/s。デュアルXeonまたはAMD Epyc、2 TB DDR5。企業向けAIのリファレンスプラットフォーム。
8 × H200 SXM5, 1.1 TB
DGX H100 の後継機です。GPUあたり4.8 TB/秒のHBM3e搭載。メモリ容量が重要な大規模モデル推論に最適です。
OEM platform (8-GPU)
GPUボード+NVSwitchコンプレックスは、OEMパートナー(Supermicro、Dell、HPE、Lenovo)に出荷されます。 カスタムサーバーシャーシで同一のGPUファブリックを実現します。
72 × GB200 GPUs
シングルラックスケールシステム。36 Grace CPU + 72 Blackwell GPUモジュール。1.44 ExaFLOPS FP4。NVLink 5ファブリック — すべてのラックが1つのGPUとして動作します。
Up to 4 × 96 GB
研究室やAIスタートアップ向けのワークステーションクラスのサーバー。デュアルソケット Xeon W9 または Threadripper Pro、4× RTX PRO 6000 BW を NVLink Bridge ペアで接続。
2 × 80 GB HBM2e
コスト効率の高い推論ノード。標準の2Uシャーシ、デュアルPCIe 5.0スロット。標準のラックコロケーションに適合し、液冷は必要ありません。
4–8 × 24 GB PCIe
高密度で低消費電力の推論。単一スロットのL4 GPUは各72 Wです。1Uに最大8 GPUを搭載し、合計で600 W未満 — co-loエッジPoPに理想的です。
汎用サーバーとAIサーバーの根本的な違いは、GPUの構成です。標準的なサーバーでは、GPUはPCIeを通じて通信します — 各スロットあたりおよそ32~64 GB/秒の双方向バスアーキテクチャです。NVSwitchベースのAIサーバーでは、システム内のすべてのGPUが同時にNVSwitch ASICを介して接続されており、H100ではGPUあたり900 GB/秒、H200 / BlackwellではGPUあたり1.8 TB/秒の帯域を持っています。これはボトルネックの改善ではなく、モデル並列性をGPU間で可能にする質的な変化であり、まるでより大きな一つのデバイスのように機能します。
CPUとメモリサブシステムは、GPUの帯域幅要求に対応する必要があります。DGX H100は、その8-GPU NVSwitchファブリックをデュアルIntel Xeon Platinum CPUと2 TBのDDR5 ECC RAMと組み合わせています — 訓練データセットのステージング、前処理パイプラインの実行、チェックポイントI/Oの管理に十分なシステムメモリで、ボトルネックにならないようになっています。PCIe 5.0レーンは慎重に配分されており、各GPUはCPUファブリックに直接x16接続されています。
電力供給はそれ自体が工学的な課題です。フル搭載のDGX H100は約10.2 kWを消費し、北米では2 × 30A、240Vの回路、ヨーロッパでは3相32Aを必要とします。冷却も同様に要求が高く、NVIDIAのリファレンス設計では、DGX構成のGPUモジュールに対してリアドア熱交換器または直接液冷を使用しています。設置前に施設の電力と冷却の計画を立てることは必須であり、これが最初のステップです。
GB200 NVL72は、NVIDIAのこれまでで最も野心的なシステムアーキテクチャです。1ラックには36のGrace CPUモジュールと72のBlackwell GB200 GPUダイが収められており、すべてが第5世代NVLinkファブリックを介して1.8 TB/秒の速度で接続されています。これにより、ラック全体が単一の論理的アクセラレータとして動作します。全72 GPUによるFP4スパースコンピュートの合計は1.44 ExaFLOPSを超え、HBM3eメモリの総容量は13.5 TBに達します。
各GB200モジュールは、Grace Arm CPUと二つのBlackwell GPUダイをNVLink-C2Cで900 GB/sで接続し、CPUとGPU間のPCIeインターフェースを完全に排除します。CPUは高帯域幅のメモリーコントローラーおよびオーケストレーションエンジンとして機能し、ボトルネックにはなりません。この設計により、NVL72は低遅延での兆パラメータモデル推論において独自の能力を持ちます。モデル全体がラックのメモリー内に収まり、全リデュース操作はNVLinkファブリック内で行われ、シングルモデルのサービスにおいてはノード間ネットワークを必要としません。
施設の観点から、NVL72は最大120 kWを消費し、直接液体冷却が必要です。専用の3相電力供給と施設の液体冷却インフラストラクチャが必須です。ハイパースケールでは経済性が非常に魅力的です:1台のNVL72ラックは、以前は同等の推論スループットを実現するために複数のDGX H100ノードの行が必要だったものを置き換えます。
実験室規模の実験から大規模展開まで — 作業負荷に適したプラットフォーム層を選択してください。
モデルの微調整、RAG開発、ローカル推論、研究の再現性。机の下やスタンダードなラックに収まります。通常、施設のアップグレードは必要ありません。
13–70Bモデルの完全な微調整。AIネイティブ製品向けの推論運用。3相電源またはデュアル30A給電が必要です。リアドアHXを用いた空冷が可能です。
70–400Bモデルのフルパラメータトレーニング。非常に大きなモデル向けの低遅延推論。液冷を推奨します。現在のAIワークロードの業界標準です。
トリリオンパラメータモデルの事前学習と大型バッチ推論。完全液体冷却と専用の三相電力 USB必須。NVLink 5を用いたラック一体型GPUアーキテクチャ。
上記の研究用グレード2-GPUノードからDGX H200およびGB200 NVL72ラックスケールシステムまで、私たちのAIサーバープラットフォームの全ラインナップをご覧ください。私たちのチームは、電力、冷却、ネットワーキング、物流の計画をトータルでサポートいたします。