Million Miner Logo
Hosting & Colocation · 18 dengan membaca minimal · Aug 04, 2026 · Diperbarui Aug 11, 2026

Harga GPU Cloud di 2026: Sewa vs Beli, dan Perhitungan Titik Impas yang Tidak Akan Anda Tampilkan

Sara Chen

Bitcoin & Altcoin Analyst

Harga GPU Cloud di 2026: Sewa vs Beli, dan Perhitungan Titik Impas yang Tidak Akan Anda Tampilkan
Survei terhadap 25 penyedia cloud menemukan bahwa NVIDIA H100 yang disewa dapat berkisar antara $0,80 dan $11,10 per jam.Produk silikon yang sama, kapasitas 80 GB yang sama, perbedaan harga 13,8 kali lipat. Fakta tunggal ini menjelaskan mengapa pertanyaan “berapa biaya GPU cloud” tidak memiliki jawaban satu baris, dan mengapa orang membakar uang nyata di kedua sisi: menyewa kapasitas hyperscaler untuk beban kerja yang akan dilayani pasar dengan seperlima harga, atau membeli kartu senilai $30.000 yang berjalan pada tingkat pemanfaatan 20% sementara sewaannya akan menghabiskan setengahnya.

Kami menjalankan aKlon cloud, jual perangkat keras yang sama secara langsung, dan hosting mesin milik pelanggan, yang berarti kami mendapatkan pembayaran di semua tiga model dan tidak memiliki insentif untuk berpura-pura salah satu dari mereka selalu menang. Panduan ini adalah peta jujur: tabel harga lengkap tahun 2026 berdasarkan tingkat penyedia, enam faktor di balik spread 13,8x, rumus break-even antara menyewa dan memiliki dengan angka yang dihitung, opsi ketiga yang diabaikan oleh binary sewa-vs-beli, dan jebakan biaya yang ada di faktur daripada di halaman harga.

Jawaban singkat

  • Tarif on-demand tipikal pertengahan 2026:H100 dari $1,49 menjadi $2,69/jam di pasar dan cloud khusus, $3,90 hingga $12,29/jam di hyperscalers; A100 dari $0,68/jam; B200 dari $3,75 hingga $16,11/jam; kelas RTX 4090 dari $0,14/jam spot.
  • Aturan yang menentukan sewa vs beli:pemanfaatan berkelanjutan. Di bawah sekitar 40%, penyewaan biasanya lebih unggul. Di atasnya, kepemilikan menjadi lebih unggul, dan inferensi 24/7 membuat kepemilikan menjadi terlalu berat.
  • Berhasil mencapai titik impas:Sekitar $30.000 H100 dibandingkan dengan sewaan $2,50/jam mencapai titik impas pada sekitar 14.000 GPU-jam, kira-kira 19 bulan dengan pemanfaatan penuh, sebelum nilai jual kembali menguranginya lebih jauh.
  • Jalur ketiga:Beli kartu tersebut, tempatkan di fasilitas hosting. Ekonomi kepemilikan tanpa harus mengelola daya, pendinginan, dan kehandalan sendiri.


Tabel harga GPU cloud 2026

Setiap angka di bawah ini merupakan rentang yang disusun sesuai permintaan dari lembar harga penyedia yang diterbitkan dan indeks terpantau pada Juli 2026. Kolom-kolom lebih penting daripada sel-selnya: pasar terdiri dari tiga bisnis berbeda yang menggunakan satu nama.
Cloud GPU price table for mid-2026: H100 from $1.49 to $12.29 per hour, A100 from $0.68, H200 from $2.30, B200 from $3.75 to $16.11, and RTX 4090 from $0.14 spot, across marketplace, specialist, hyperscaler, and spot tiers.
Pasar(Vast.ai, Tingkatan komunitas RunPod) menggabungkan ribuan host pihak ketiga dan menampilkan harga termurah, H100 dari $1,49, RTX 4090 dari $0,14 spot, dengan keandalan yang bervariasi dari host ke host.Spesialis cloud(Lambda, CoreWeave, RunPod aman) menjalankan armada mereka sendiri: H100 sekitar $1,99 sampai $3,99, titik manis di mana sebagian besar beban kerja serius berada.Hyperscaler(AWS, Azure, GCP) harga yang sama untuk kartu seharga $3,90 hingga $12,29 dengan SLA perusahaan, kepatuhan, dan bundling whole-VM, dan bahkan mereka pun mengalami penurunan: AWS memotong tarif H100 sekitar 44% pada pertengahan 2025. Dua dinamika membentuk 2026: kartu generasi sebelumnya terus menurun mendekati harga komoditas (A100 dari $0,68, dengan analis memperkirakan di bawah $1 secara umum), sementara silikon terbaru berjalan sebaliknya, listing B200 dan B300 hampir dua kali lipat dalam setahun karena pasokan yang terbatas memenuhi premi hyperscaler. Kartu mana yang benar-benar dibutuhkan workload Anda adalah pertanyaan terpisah, yang dijawab oleh VRAM terlebih dahulu dan throughput kedua, yang merupakan fokus dari kamiPanduan VRAMdanalat pengujian kinerjaada untuk.

Mengapa H100 yang sama biaya $0,80 atau $11,10 per jam

Why H100 rental prices vary 13.8x: SLA and uptime guarantees, interconnect class (PCIe vs SXM with NVLink), commitment terms, whole-VM bundling, egress and storage fees, and host quality by region.
Tidak ada dari spread ini yang penipuan; semuanya adalah perbedaan produk yang disembunyikan di balik satu nama GPU. Daftar pasar sebesar $0,80 adalah sebuah kartu PCIe sederhana di perangkat keras milik seseorang tanpa janji uptime. Instansi hyperscaler seharga $11 adalah sebuah kartu SXM dengan NVLink di dalam mesin ber-8 GPU, yang dilengkapi CPU, RAM, dan disk, dengan SLA 99,9% dan departemen kepatuhan. Di antara keduanya terdapat perbedaan yang benar-benar menentukan harga pasar: kelas interkoneksi (sebuah PCIe H100 dan sebuah SXM H100 yang terhubung NVLink adalahmesin yang berbedauntuk pekerjaan multi-GPU), syarat komitmen (penawaran reserved 1 hingga 12 bulan berjalan 20 hingga 40% lebih rendah dari on-demand, spot berjalan 40 hingga 65% lebih rendah dengan risiko gangguan), dan apa yang digabungkan versus yang dikenai biaya terpisah. Aturan praktis: jangan pernah membandingkan harga antar tingkatan, hanya dalam satu tingkatan, dengan semua enam faktor tetap sama, dan anggap setiap perbandingan harga seluruh-VM versus harga bare-card sebagai rusak secara konstruk.

Sewa vs beli: perhitungan titik impas

Sewa tidak memerlukan capex dan tidak ada komitmen; memiliki memiliki harga pembelian dan nilai jual kembali. Perpotongan di antara keduanya hanyalah satu divisi, dan hampir tidak ada yang mempublikasikannya dengan asumsi yang melekat.
GPU rent-vs-buy break-even: net purchase cost divided by rental rate minus owning cost per hour; a $30,000 H100 against $2.50/hr rental crosses near 14,000 GPU-hours, an RTX 4090 48GB near 4,700 hours, with resale value cutting effective break-even 30 to 40 percent.
Kerjakan kasus unggulan. Sebuah H100 berharga sekitar $25.000 hingga 40.000 baru; ambil $30.000, tambahkan hosting profesional dengan biaya sekitar $0,35 per GPU-jam termasuk daya, dan sewa kelas yang sama dengan biaya sekitar $2,50. Titik impas berada di dekat 14.000 GPU-jam: sekitar 19 bulan dengan pemanfaatan 100%, empat tahun dengan 40%. Sekarang dua koreksi yang mempengaruhinya.Resale adalah uang nyata: GPU pusat data tetap bernilai (A100 yang digunakan masih diperdagangkan di kisaran $4.000 hingga 9.000 tahun setelah peluncuran), dan residual sebesar 40 hingga 50% setelah dua tahun mengurangi titik impas efektif sekitar sepertiga.Pemanfaatan adalah segalanyaPada siklus tugas 20%, pembelian tidak pernah mengembalikan modal sebelum usang; pada inference 24/7 yang stabil, modal kembali dalam waktu kurang dari dua tahun dan kemudian menghasilkan laba. Itulah seluruh keputusan, dan itulah sebabnyaaturan 40%dari analisis kami tentang A100 vs H100 secara umum: di bawah penggunaan berkelanjutan sekitar 40% sewa, di atasnya milik sendiri. Tarif listrik Anda juga memindahkan garis tersebut, karena daya adalah biaya operasional utama, ekonomi yang sama dipetakan studi energi AI kami pada skala jaringan listrik.

Satu ketidakseimbangan yang jujur: menyewa memungkinkan Anda untuk mengubah pendapat tentang chip tersebut. Memiliki H100 melalui theTransisi Rubinberarti menurunkan kurva resale-nya; menyewa berarti beralih bulan depan. Beri nilai fleksibilitas itu, itu bukan gratis tetapi juga bukan tidak berharga.

Siap Memulai Penambangan?

Pengiriman DDP gratis seluruh dunia. Hosting profesional mulai dari $0.055/kWh.

Jalur ketiga: beli dan colocate

The three GPU capacity paths compared: renting (elastic, perpetual cost), buying and self-hosting (cheapest but you run power, cooling, and uptime), and buying plus colocation (ownership economics with data-center operations handled).
Kerangka sewa-vs-beli diam-diam mengasumsikan bahwa membeli berarti menjadi Rechenzentrum sendiri, dan asumsi itu melakukan sebagian besar pekerjaan dalam kesimpulan yang mendukung sewa, karena penyediaan daya, pendinginan, jaringan, dan kegagalan pukul 3 pagi benar-benar mahal untuk dioperasikan sendiri. Jalur yang sebenarnya digunakan operator membagi perbedaan:beli perangkat keras, tempatkan di rechenzentrumDalam sebuah fasilitas yang menjual daya kontrak, pendinginan, dan Betriebszeit, model di balik kamiHosting GPUdan alasan perusahaan pertambangan beralih keInfrastruktur AIJadi secara alami, karena keahlian fasilitas adalah identik. Colocation menambahkan biaya hosting pada kolom kepemilikan, sekitar $0,35/jam dalam contoh yang telah dikerjakan di atas, dan sebagai gantinya menghilangkan setiap keberatan operasional terhadap kepemilikan. Untuk beban kerja yang stabil di atas garis 40%, biasanya ini adalah jalur biaya-total termurah yang tersedia, dan inilah mengapa kami menjualnya, sebuah bias yang harus Anda pertimbangkan bersamaan dengan perhitungannya.
A GPU cluster racked in a data center: whether rented by the hour or owned and colocated, this is the hardware every cloud GPU price ultimately meters.


Enam perangkap biaya yang disembunyikan oleh tarif per jam

Six cloud GPU cost traps: whole-VM versus bare-card pricing, egress fees, idle billing on attached resources, spot interruption losses, minimum commitments behind headline rates, and availability as the real price.
Tarif per jam adalah harga yang diiklankan; faktur adalah yang sebenarnya. Jerat, dalam urutan kerusakan kasar: membandingkan hypoercalerharga seluruh VM(CPU, RAM, dan disk termasuk) terhadap kartu dasar pasar; biaya keluar saat memindahkan bobot dan dataset ke luar, yang beberapa cloud khusus tidak mengenakan biaya dan hyperscalers mengenakan biaya cukup tinggi;penagihan saat idlepada volume yang terpasang dan instance yang telah dialokasikan namun dihentikan;gangguan sementaramenghapus jalur pelatihan yang tidak dicheckpoint, mengonversi diskon 60% menjadi kerugian bersih; tarif headline yang ternyata menjadi1- hingga 12-bulankomitmen dengan permintaan sesuai kebutuhan sebanyak dua kali lipat; dan yang tenang,KetersediaanTier termurah yang terjual habis di wilayah Anda sesuai skala Anda berarti harga nyata adalah tier berikutnya. Anggarkan kapasitas yang dapat diperoleh, verifikasi apa yang thebeban kerja pelatihansebenarnya perlu dipenuhi sebelum memesan, dan baca halaman penagihan seakurat halaman harga.

Apa panduan ini tidak dapat tentukan untuk Anda

Tiga batasan, dijelaskan secara sederhana. Pertama, harga-harga ini adalah cuplikan bulan Juli 2026 dari pasar yang bergerak setiap bulan, kartu generasi tengah menurun nilainya, kartu terbaru mengalami lonjakan karena kelangkaan, dan penyedia memotong tarif dalam persentase dua digit tanpa pemberitahuan, jadi perlakukan setiap angka sebagai rentang yang harus diverifikasi terhadap halaman langsung, termasukmilik kami, sebelum menginvestasikan uang. Kedua, matematika impas adalah perencanaan arah, bukan kutipan: tarif listrik Anda, biaya hosting yang dinegosiasikan, biaya pembiayaan, dan waktu penjualan kembali semuanya mempengaruhi titik temu, dan contoh-contoh yang dihitung menyatakan asumsi mereka sehingga Anda dapat mengganti dengan yang sesuai. Ketiga, kami adalah penjual di pasar ini tiga kali lipat, awan, perangkat keras, dan hosting, itulah sebabnya setiap rekomendasi di sini dapat direduksi menjadi rumus yang dapat Anda periksa daripada klaim yang harus Anda percayai. Jalankan pemanfaatan Anda secara jujur; itu akan memutuskan untuk Anda.

Kesimpulan utama

Harga GPU Cloud pada tahun 2026 merupakan pasar tiga tingkatan dengan selisih 13,8x untuk silikon yang sama: marketplace dari $1,49/jam untuk H100, spesialis sekitar $2 hingga $4, hyperscaler hingga $12, dengan kartu generasi sebelumnya yang beralih ke tarif komoditas sementara scarcity kelas B200 mempertahankan premi. Jawaban sewa-vs-beli adalah pertanyaan utilisasi yang memakai kostum harga: di bawah penggunaan berkelanjutan sekitar 40%, sewa, idealnya pada tingkat termurah yang keandalannya dapat ditoleransi oleh beban kerja Anda; di atas itu, miliki, dan biarkan kolokasi menghilangkan alasan operasional; dan selalu berikan harga pada jalur ketiga sebelum menerima biner. Cocokkan kartu dengan beban kerja dengan thePanduan pemilihan, kepemilikan harga dalamToko GPUdan di sisi mana pun dari garis impas Anda berada, buatlah garis itu sendiri, bukan judul halaman harga, yang menentukan.

Pertanyaan yang Sering Diajukan

Berapa biaya menyewa GPU di cloud?

Rentang layanan on-demand pertengahan 2026: H100 80GB mulai dari $1,49 hingga $2,69/jam di pasar dan cloud spesialis serta $3,90 hingga $12,29/jam di hyperscalers; A100 80GB mulai dari $0,68/jam; H200 sekitar $2,30/jam; B200 dari $3,75 hingga $16,11/jam; kartu konsumen kelas RTX 4090 dari $0,14/jam spot. Komitmen cadangan mengurangi biaya sebesar 20 hingga 40% pada instance on-demand dan spot, dengan risiko gangguan. Harga berubah setiap bulan, mohon periksa halaman langsung sebelum menganggarkan.

Berapa biaya menyewa H100 per jam?

Dari sekitar $1,49/jam di pasar GPU (kelas Vast.ai), $1,99 hingga $3,99/jam di cloud khusus (kelas RunPod, Lambda, CoreWeave), dan $3,90 hingga $12,29/jam di hyperscalers (AWS, Azure, GCP), per pertengahan 2026. Sebuah survei terhadap 25 penyedia menemukan variasi penuh yang berkisar dari $0,80 hingga $11,10 untuk silikon yang sama. Perbedaan tersebut digunakan untuk SLA, kelas interkoneksi, bundling, dan kepatuhan, bukan untuk chip yang lebih cepat.

Apakah lebih murah menyewa atau membeli GPU untuk AI?

Ini hampir sepenuhnya bergantung pada Utilisasi yang berkelanjutan. Di bawah siklus tugas sekitar 40%, menyewa biasanya lebih murah karena peralatan milik yang tidak aktif tetap menanggung biaya pembeliannya. Di atas 40%, memiliki perangkat lebih unggul: sebuah Miner H100 sekitar $30.000 dibandingkan dengan sewa $2,50/jam seimbang di dekat 14.000 GPU-jam (sekitar 19 bulan dengan Utilisasi penuh), dan nilai jual kembali mengurangi itu sekitar sepertiga. Inferensi yang stabil 24/7 membuat kepemilikan jauh lebih murah.

Mengapa harga GPU cloud berbeda-beda antara penyedia layanan?

Karena nama GPU yang sama mencakup produk yang berbeda. Marketplace mencantumkan kartu kosong di host pihak ketiga tanpa SLA; cloud khusus menjalankan armada milik sendiri dengan dukungan; hyperscalers menggabungkan sumber daya VM lengkap, SLA perusahaan, dan kepatuhan. Tambahkan kelas interkoneksi (PCIe vs NVLinked SXM), diskon komitmen sebesar 20 hingga 40%, diskon spot sebesar 40 hingga 65%, kebijakan egress, dan pasokan regional, dan spread 13,8x untuk silikon yang sama adalah hasil yang bisa diprediksi.

Apa cara termurah untuk menjalankan beban kerja AI pada GPU?

Untuk beban kerja yang spike atau eksperimental: instance pasar spot atau komunitas dengan checkpointing, mulai dari $0,14/jam untuk kartu kelas RTX 4090 dan sekitar $2,25/jam untuk H100 spot. Untuk beban kerja produksi yang stabil: memiliki perangkat keras dan menempatkannya di fasilitas hosting biasanya lebih menguntungkan di atas utilisasi sekitar 40%, menggabungkan ekonomi kepemilikan dengan kekuatan dan uptime profesional. Kesalahan paling mahal yang umum adalah menjalankan inferensi stabil 24/7 dengan tarif hyperscaler on-demand.

Harga sewa GPU sedang naik atau turun?

Keduanya, berdasarkan generasi. Kartu generasi sebelumnya terus turun harganya: AWS memotong harga H100 sekitar 44% pada pertengahan 2025, tarif H100 khusus sekarang mulai di bawah $2, dan A100 diperdagangkan mulai dari $0,68/jam dengan analis memperkirakan harga di bawah $1 secara umum. Semikonduktor terbaru berjalan berlawanan: listing B200 dan B300 on-demand hampir dua kali lipat selama setahun terakhir karena pasokan yang terbatas bertemu dengan harga hyperscaler premium. Harapkan setiap generasi mengikuti pola yang sama: langka dan mahal, kemudian melimpah dan sebagai komoditas.

Biaya tersembunyi yang terkait dengan GPU cloud meliputi biaya data keluar yang tinggi, biaya penyimpanan yang tidak termasuk dalam paket utama, biaya transfer data antar wilayah atau zona, biaya penggunaan sumber daya tambahan atau fitur premium, serta biaya penghematan atau lisensi perangkat lunak yang mungkin dikenakan oleh penyedia layanan. Selain itu, biaya downtime atau pemeliharaan yang tidak terduga juga dapat mempengaruhi total pengeluaran.

Yang berulang: biaya keluar data saat memindahkan model dan dataset (nol di beberapa cloud khusus, signifikan di hyperscalers), penagihan penyimpanan dan idle pada volume yang terpasang dan instance yang dihentikan, harga VM lengkap yang menggabungkan CPU dan RAM yang belum Anda tetapkan harga, serta komitmen minimum di balik tarif utama. Yang paling merusak: gangguan spot yang menghapus jalannya pelatihan tanpa checkpoint, yang mengubah diskon 60% menjadi kerugian bersih. Baca dokumentasi penagihan, bukan hanya halaman harga.

Apakah membeli GPU mempertahankan nilainya?

Lebih baik daripada sebagian besar perangkat keras. GPU Rechenzentrum mempertahankan nilai resale yang berarti selama bertahun-tahun: A100 bekas masih diperdagangkan pada kisaran $4.000 hingga 9.000, dan H100 tetap memiliki residual yang kuat sementara permintaan melebihi pasokan. Residual yang realistis sebesar 40 hingga 50% setelah dua tahun memperpendek titik impas sewa-versus-beli sebesar sekitar sepertiga. Risikonya bersifat generasional: setiap arsitektur baru (B200 sekarang, Rubin berikutnya) mempertinggi kurva depresiasi dari yang sebelumnya.

Apa itu kolokasi GPU dan kapan hal itu masuk akal?

Colocation berarti Anda memiliki GPU dan sebuah fasilitas hosting mengoperasikannya: daya yang dikontrak, pendinginan, jaringan, dan uptime dengan biaya bulanan atau per jam. Ini masuk akal ketika pemanfaatan Anda berada di atas sekitar 40% untuk jangka panjang tetapi Anda tidak ingin mengelola daya dan pendinginan sendiri: Anda mempertahankan ekonomi kepemilikan dan nilai jual kembali sambil mengalihdayakan masalah data centre. Ini adalah jalur standar untuk beban kerja inferensi yang stabil dan model yang dijalankan bisnis hosting kami sendiri.

Haruskah saya menyewa B200 atau membeli H100 pada tahun 2026?

Untuk sebagian besar tim: tidak ekstrem. Penyewaan B200 memiliki premi kelangkaan ($3,75 hingga 16,11/jam) dan antrean reservasi, sementara membeli H100 mendekati transisi Rubin berarti mengikuti kurva penjualan kembali yang semakin curam. Rencana pragmatik 2026: sewa kapasitas H100/H200 di cloud khusus (di bawah $3/jam) untuk pekerjaan yang fleksibel, atau beli dan colocate kartu workstation H100-class atau 48 hingga 96 GB untuk inference yang stabil di atas garis utilisasi 40%. Ulangi analisis break-even saat harga Rubin tercapai.

Sumber dan catatan
Rentang harga disusun Juli 2026 dari lembar harga penyedia yang dipublikasikan (Lambda, RunPod, Vast.ai, CoreWeave, AWS, Azure, GCP) dan indeks yang dipantau termasuk indeks GPU bulanan dari AIMultiple yang terdiri dari 67 penyedia; angka spread 13,8x berasal dari survei komunitas 2026 terhadap 25 penyedia; potongan harga AWS ~44% H100 berasal dari pengumuman harga Juni 2025. Harga pembelian dan aturan 40% utilisasi mengikuti analisis A100 vs H100 kami; rentang pasar bekas mencerminkan daftar mid-2026. Contoh titik impas menyebutkan asumsi mereka dalam teks dan merupakan angka perencanaan arah, bukan kutipan; biaya hosting mengasumsikan kolokasi profesional termasuk daya pada tarif kontrak tipikal. Kami mengoperasikan GPU cloud, menjual GPU, dan menghost perangkat keras pelanggan; posisi ganda ini diungkapkan dalam artikel. Semua harga berubah setiap bulan; verifikasi halaman langsung sebelum keputusan pembelian. Hero: Departemen Energi AS, domain publik; badan: CSIRO, CC BY 3.0, melalui Wikimedia Commons. Diagram: grafik asli MillionMiner, bebas digunakan kembali dengan atribusi dan tautan ke halaman ini. Konten informatif, bukan saran keuangan

Siap Memulai Penambangan?

Pengiriman DDP gratis seluruh dunia. Hosting profesional mulai dari $0.055/kWh.

Sara Chen

Ditulis oleh

Sara Chen

Bitcoin & Altcoin Analyst

Sara covers network fundamentals, mining economics, and emerging proof-of-work protocols. She holds a background in applied mathematics and has tracked Bitcoin difficulty adjustments since block 600,000.

Komentar 0

Tolong Masuk untuk meninggalkan komentar

Hapus Komentar?

Tindakan ini tidak dapat dibatalkan.