Hosting server AI perusahaan dan rak GPU berkapasitas tinggi di Rechenzentrum Tier-3 AS kami. Daya listrik all-inclusive mulai dari $0,07/kWh tanpa biaya pemeliharaan tambahan, tanpa biaya pengaturan, dan layanan remote hands di lokasi 24/7.
Seperti yang dipaparkan di
Kami adalah operator, bukan broker — situs kami sendiri, gardu induk kami sendiri, staf kami sendiri di lapangan.
Pelatihan, inferensi, visi, dan komputasi ilmiah — empat bentuk beban kerja yang kami dukung saat ini, dengan kerangka kerja yang digunakan oleh masing-masing.
Pelatihan model skala besar di seluruh kluster multi-node, dengan konektivitas dan densitas daya yang menjaga all-reduce agar tidak menjadi hambatan.
PyTorchDeepSpeedMegatron-LMvLLMFSDPNCCLPenerapan API dengan latensi ultra-rendah untuk LLM lokal, model visi-bahasa, dan pipeline RAG perusahaan pada perangkat keras fisik khusus.
TensorRT-LLMTritonvLLMSGLangKServeRendering batch dengan kepadatan tinggi, pipeline Stable Diffusion, dan beban kerja video AI generatif yang penagihannya berdasarkan GPU-jam di tempat lain.
ComfyUIDiffusersOpenCVFFmpeg NVENCKomputasi berkinerja tinggi, simulasi berbasis matriks yang intensif dan kluster komputasi ilmiah yang berjalan terus-menerus selama berbulan-bulan.
CUDAMPISlurmJAXOpenMMIni adalah infrastruktur GPU dan AI — bukan perangkat keras penambangan ASIC. Pilih bentuk faktor yang Anda gunakan dan lihat bagaimana posisinya di lantai kami.
1U hingga 8U
Workstation dan node server dengan GPU tunggal atau multiple GPU. Kendaraan utama untuk inferensi, penyempurnaan, dan beban kerja campuran.
8-GPU SXM
Sistem SXM yang padat ini menjalankan pelatihan serius, dengan pendinginan udara atau cairan tergantung pada lokasi penempatan Anda.
Kabinet 42U
Kabin pre-integresi yang kami daya, dinginkan, kabelkan, dan uji beban sebagai satu unit, sehingga rak tiba di lokasi sebagai sistem jadi jadi.
Tanpa delay
Beli sistem dari toko perangkat keras AI kami dan langsung dipindahkan dari inventaris kami ke lantai Rechenzentrum — tanpa pengiriman, tanpa bea cukai, tanpa penundaan.
Hyperscalers menyewakan waktu Anda. Cloud GPU tanpa aset menyewakan kotak orang lain untuk Anda. Kami menjalankan bangunan tempat perangkat keras Anda berada.
Tiga rentang kapasitas berdasarkan konsumsi daya dan ruang rak. Tarif yang dipublikasikan, waktu penyelesaian yang dipublikasikan. Penawaran Anda mengonfirmasi lokasi, densitas, dan jangka waktu.
Semua paket termasuk daya, pendinginan, keamanan fisik, transit jaringan, dan layanan jarak jauh. Tidak ada biaya pemasangan, tidak ada biaya pemeliharaan tambahan, dan tidak ada tagihan keluar.
Pilih node Anda, jumlah dan masa berlaku Anda. Angka akan diperbarui saat Anda mengetik — tanpa perlu email gate.
Lambda on-demand H100 berada di sekitar $2,99/GPU-jam; AWS p5 on-demand jauh lebih tinggi. Tingkatkan agar sesuai dengan penawaran yang Anda terima.
Hanya bersifat indikatif. Daya dihitung berdasarkan konsumsi yang diukur pada tarif band yang berlaku; penawaran nyata akan mengonfirmasi lokasi, ruang rak, metode pendinginan, dan jangka waktu.
Belum memiliki GPU? Beli sistem dari kami dan tidak pernah meninggalkan rantai pasokan kami — itu langsung dari inventaris kami ke lantai Rechenzentrum.
1
Pilih platform NVIDIA HGX yang sudah tersedia atau server GPU PCIe dari katalog kami, atau beritahu kami beban kerja Anda dan kami akan menyesuaikan ukurannya untuk Anda.
2
Peralatan langsung dipindahkan dari inventaris kami ke lantai Rechenzentrum — DDP, tanpa pajak pengiriman, tanpa penanganan bea cukai dari pihak Anda.
3
Keuangan perangkat keras dan hosting dalam satu laporan gabungan, dengan satu insinyur akun untuk keduanya.

8× H200 141GB HBM3e · Tersedia, baru dengan garansi, dipasang dalam minggu pesanan Anda dikonfirmasi.

8× RTX 6000 Ada · Tersedia, baru dengan garansi, dipasang dalam minggu pesanan Anda dikonfirmasi.

Pra-instalasi, 20–80 kW · Tersedia, baru dengan garansi, dipasang dalam minggu pesanan Anda dikonfirmasi.

Daya listrik industri, pendinginan, dan Betriebszeit adalah bagian yang benar-benar sulit dari hosting AI — dan itulah yang sudah kami operasikan, setiap hari, secara skala besar.
Apa yang akan ditanyakan oleh CTO dan pemimpin DevOps Anda sebelum menandatangani: redundansi daya, cadangan pendinginan, dan rekam jejak operasional.

Fasilitas utilitas didukung oleh UPS N+1 / 2N, generator diesel industri di lokasi, dan kontrak bahan bakar selama 72 jam. Sistem trafo kami sendiri berarti kami membeli listrik dengan tarif industri dan meneruskannya, daripada menjual kembali dari pihak lain.

Pendingin udara presisi tingkat lanjut hari ini, penukar panas pintu belakang (RDHx) untuk kabinet padat, dan pendinginan cair langsung ke chip (DLC) mendukung instalasi Blackwell dan B200 dengan daya 100 kW+

Didasarkan pada bertahun-tahun menjalankan infrastruktur berkepadatan tinggi dengan 99,9% Betriebszeit di empat lokasi di AS, dengan teknisi secara fisik berada di lantai 24/7 — bukan antrean dispatch.
25 MW
25 MW
25 MW
20 MW
Pelatihan terdistribusi mati pada interkoneksi jauh sebelum mati pada GPU. Kedua bidang, dirancang secara terpisah.
Geser diagram secara horizontal →
Uplink carrier Tier-1 yang redundan pada 10 GbE dan 100 GbE, alokasi IPv4 dan IPv6 statis, sesi BGP khusus sesuai permintaan, dan rencana bandwidth datar tanpa biaya egress opsional — sehingga melepas checkpoint tidak akan menimbulkan biaya.
Jaringan InfiniBand berlatensi sangat rendah (HDR 200G / NDR 400G) dan RoCE v2 untuk pelatihan multi-node HGX dan DGX secara terdistribusi, dengan topologi spine-leaf non-blocking yang disesuaikan dengan jumlah node Anda.
Anda mengelola perangkat keras seolah-olah itu berada di rak Anda sendiri. Kami menangani semua hal yang memerlukan kehadiran secara fisik.
Keamanan aset fisik, kontrol akses, dan kerangka kepatuhan yang menjadi dasar pembangunan fasilitas kami.
Penyesuaian fasilitas dengan kerangka kepatuhan SOC 2 Tipe II, ISO 27001, dan HIPAA. Dokumentasi audit dan pemetaan kontrol dibagikan di bawah NDA selama proses due diligence teknis.
Akses multi-faktor biometrik, pengawasan CCTV 24/7 dengan retensi selama 90 hari, akses perimeter yang dikontrol dan prosedur pendampingan yang dicatat untuk setiap kunjungan ke lantai.
Opsi jaringan terisolasi, kandang khusus pribadi, dan perlindungan NDA klien sebagai standar. Kami tidak pernah menyentuh beban kerja, model, atau data Anda — kami menjalankan bangunan di sekitarnya.
Kami akan memberi tahu Anda secara jujur jika hosting tidak cocok untuk apa yang Anda lakukan.
Untuk benchmark satu kali, hackathon, penyempurnaan dua minggu, atau jalannya evaluasi yang melonjak, penyewaan GPU per jam adalah alat yang tepat. Anda membayar premi per jam, tetapi Anda membayarnya untuk jam-jam tersebut daripada bulan, dan tidak ada yang menganggur.
Juga sewa kapan penggunaan Anda benar-benar di bawah sekitar 25%, atau Anda belum memutuskan generasi GPU mana yang Anda perlukan.
Untuk pelatihan model terus-menerus atau inferensi LLM produksi yang berlangsung lebih dari 90 hari, memiliki perangkat keras dan menghosting-nya dengan kami mengurangi total biaya kepemilikan hingga lebih dari 60% jika dibandingkan dengan penyewaan cloud — dan GPU tetap menjadi milik Anda di akhir masa kontrak.
Juga host saat Anda memerlukan kinerja bare-metal, kapasitas terjamin, kedaulatan data, atau Anda tidak dapat memperoleh kuota H100/H200 di lokasi Anda.
Jumlah node Anda dan periode terhadap tarif referensi cloud langsung.
78 GPU dan 48 server dibandingkan berdasarkan VRAM, throughput inferensi, dan pelatihan.
Das benchmarks dan terminologi dalam bahasa mudah, sehingga Anda dapat memilih kartu yang tepat.
NVIDIA H100, H200 dan node yang sudah dirakit, baru dengan garansi, pengiriman DDP gratis seluruh dunia.
Tiga bentuk yang paling sering kami tawarkan, beserta daya, jadwal waktu, dan kisaran operasional yang menyertainya.
Setiap penerapan berjalan dengan komitmen uptime 99,9%, cakupan remote-hands yang sama, dan portal telemetri yang sama.
Beritahu kami beban kerja dan perkiraan kebutuhan komputasi Anda. Seorang insinyur infrastruktur akan kembali dengan tarif, lokasi, metode pendinginan, dan jadwal. Tidak ada komitmen — dan kami akan memberi tahu jika hosting bukan pilihan yang tepat.
Dipercaya oleh lebih dari 1.200 pelanggan · seorang insinyur membalas 09:00–21:00 CET, setiap hari.
Dua menit. Ini langsung menghubungkan Anda ke spesialis infrastruktur AI.