Sederhana dan Transparan Harga

Bayar hanya yang Anda pakai. Tanpa biaya tersembunyi. Tanpa biaya egress. Bisa dihentikan kapan saja.

Hingga 60% lebih murah

dibanding RunPod pada model GPU yang sama

Infrastruktur Multi-Region

GPU di APAC dan sekitarnya. Latensi rendah untuk pengembang di India, Asia Tenggara, Amerika Latin, dan Eropa.

Deploy 60 detik

Berbasis browser. Tanpa SSH, tanpa setup.

Model GPUStokCloudGPUVast.aiRunPod
RTX 3090 24GDipasok lewat agent P2PStok menipis$0.20/hr$0.22/hr$0.22/hr
RTX 4090 24GStok menipis$0.32/hr$0.32/hr$0.34/hr
RTX 4090D 48G4090 spesifikasi Tiongkok, VRAM 48GBStok menipis$0.59/hrN/AN/A
5090 32GStok menipis$0.49/hrN/AN/A
A100 40GStok menipis$0.89/hr$0.80/hr$1.89/hr
L20 48GAda spesifikasi Tiongkok, VRAM besarStok menipis$0.89/hrN/A$1.20/hr
L40 48GStok menipis$0.79/hrN/A$1.19/hr
L40S 48GStok menipis$1.19/hr$1.65/hr$1.89/hr
H20 96GHopper spesifikasi Tiongkok, HBM3 besarStok menipis$1.59/hrN/AN/A
Ascend 910B 64GNPU — hanya CANN / MindSpore / PyTorch-NPUStok menipis$0.85/hrN/AN/A
A800 80GChina-spec A100Stok menipis$1.39/hrN/A$2.17/hr
H800 80GH100 spesifikasi Tiongkok, NVLink dibatasi 400Gb/sStok menipis$3.49/hrN/A$3.99/hr

Vast.ai / RunPod rates observed April 2026 for equivalent SKU. "N/A" = competitor does not offer that GPU in their catalog.

Performa & Kecocokan Beban Kerja

Harga saja tidak menentukan GPU mana yang tepat. L20, H20, dan Ascend 910B adalah kartu spesifikasi Tiongkok yang tidak dijual cloud AS — profil VRAM dan bandwidth-nya khas dan layak dibandingkan.

GPUArsitekturVRAMFP16 TFLOPSBW MemoriPaling Cocok Untuk
RTX 3090 24G
Dipasok lewat agent P2P
Ampere24 GB36936 GB/sInferensi LLM ≤ 7B, Stable Diffusion, mesin dev murah
RTX 4090 24G
Ada24 GB731008 GB/sFine-tuning 7B-13B, Flux / SDXL, inferensi cepat
RTX 4090D 48G
4090 spesifikasi Tiongkok, VRAM 48GB
Ada48 GB731008 GB/sFine-tuning 13B-30B dengan batch besar, inferensi 70B terkuantisasi
5090 32G
Blackwell32 GB1041792 GB/sFlagship konsumen terbaru — fitur Blackwell, cepat untuk SD/Flux
A100 40G
Ampere40 GB3121555 GB/sPelatihan / fine-tune LLM 13B-30B, riset
L20 48G
Ada spesifikasi Tiongkok, VRAM besar
Ada48 GB119864 GB/sInferensi 32B, melayani banyak model, beban kerja rakus VRAM
L40 48G
Ada48 GB90864 GB/sInferensi 32B, visualisasi + komputasi sekaligus
L40S 48G
Ada48 GB183864 GB/sInferensi kelas atas + pelatihan ringan, lebih baik dari L40
H20 96G
Hopper spesifikasi Tiongkok, HBM3 besar
Hopper96 GB1484000 GB/sInferensi 70B-120B, konteks panjang, model MoE
Ascend 910B 64G
NPU — hanya CANN / MindSpore / PyTorch-NPU
Ascend64 GB3201200 GB/sPelatihan yang patuh regulasi domestik, beban kerja MindSpore/PyTorch-NPU
A800 80G
China-spec A100
Ampere80 GB3122039 GB/sPelatihan FP32/FP16 30B-70B, riset dengan memori besar
H800 80G
H100 spesifikasi Tiongkok, NVLink dibatasi 400Gb/s
Hopper80 GB9893350 GB/sPelatihan frontier, fine-tuning 70B+, inferensi FP8

VRAM menentukan ukuran model

24 GB muat 7B pada FP16 / 30B terkuantisasi. 48 GB muat 13B pada FP16 / 70B terkuantisasi. 96 GB nyaman menjalankan 70B FP16.

Mem bandwidth = tokens/sec

Untuk inferensi LLM, throughput mengikuti bandwidth memori, bukan TFLOPS. Untuk melayani model besar, 4 TB/s milik H20 mengungguli A100.

FP16 TFLOPS = training speed

312 TFLOPS milik A100 unggul untuk fine-tuning. Angka 320 milik 910B ada di atas kertas — kecepatan nyatanya bergantung pada kematangan ekosistem CANN/MindSpore.

Kalkulator Biaya

1x
8h
7 days

1x RTX 4090 24G · 56 total hours

$17.92

Save $1.12 vs RunPod

6% cheaper than RunPod

Sewa Sekarang

Paket Harga

Sesuai Pemakaian

Bayar sesuai pemakaian. Tanpa komitmen.

Harga Pasar

  • check Penagihan per jam
  • check Bisa dihentikan kapan saja
  • check Tanpa minimum belanja
  • check Semua model GPU
Mulai
Paling Hemat

Bulanan

Komitmen bulanan, hemat 30%.

Diskon 30%

dari tarif per jam

  • check Semua yang ada di paket Sesuai Pemakaian
  • check Diskon 30% untuk semua GPU
  • check Prioritas penyediaan
  • check Dukungan email
Berlangganan

Saldo Prabayar

Beli saldo sekaligus, dapat bonus.

$100 → $110

Bonus saldo 10%

  • check Bonus 10% untuk setiap isi saldo
  • check Saldo tidak kedaluwarsa
  • check Bisa dipakai di semua model GPU
  • check Saldo dapat dipindahkan
Beli Saldo

Tanpa biaya tersembunyi · Tanpa biaya egress · Ditagih per jam · Bisa dihentikan kapan saja