Dokumen ini menjelaskan jenis reservasi yang dapat Anda gunakan untuk memesan kapasitas guna membuat instance Compute Engine. Untuk mempelajari lebih lanjut resource yang Anda butuhkan untuk membuat instance komputasi, lihat Instance Compute Engine.
Pemesanan memberikan jaminan yang sangat tinggi bagi project Anda bahwa resource zona tersedia saat Anda membutuhkannya untuk membuat instance komputasi. Anda dapat memesan hardware inti (vCPU dan memori) serta resource terlampir (GPU, TPU, disk SSD Lokal, dan kumpulan Hyperdisk). Jika Anda membagikan reservasi, hingga 100 project di organisasi Cloud de Confiance by S3NS Anda akan mendapatkan jaminan kapasitas yang sama. Anda dapat menggunakan resource yang dipesan kapan saja untuk membuat instance komputasi dengan properti yang cocok dengan reservasi Anda.
Pemesanan menawarkan manfaat berikut:
Jaminan kapasitas tinggi: Anda menyimpan resource di zona tertentu untuk mempersiapkan peningkatan permintaan pada masa mendatang, seperti pertumbuhan, lonjakan traffic, migrasi database besar, atau pemulihan dari bencana.
Akses eksklusif: Anda membatasi akses ke resource yang dicadangkan sehingga project lain, baik di dalam maupun di luar organisasi Anda Cloud de Confiance, tidak dapat menggunakannya. Membatasi akses membantu memastikan bahwa workload Anda memiliki resource yang diperlukan untuk dijalankan.
Retensi kapasitas: Anda mempertahankan vCPU, memori, GPU, TPU, disk SSD Lokal, dan kapasitas penyimpanan (jika disertakan dalam reservasi Anda) meskipun Anda menghentikan instance komputasi. Kemudian, Anda dapat memulai ulang instance komputasi tersebut tanpa mengalami error ketersediaan resource.
Konfigurasi yang konsisten: instance komputasi yang Anda buat dengan menggunakan resource yang dicadangkan memiliki penyiapan hardware dan penyimpanan yang identik. Pendekatan ini membantu memastikan performa yang konsisten dan menghindari penundaan pemrosesan di seluruh instance komputasi Anda.
Setelah Compute Engine menyediakan resource yang dipesan, Anda akan membayar resource tersebut, terlepas dari apakah Anda menggunakannya atau tidak, dan selama pemesanan masih ada. Saat membuat instance komputasi dengan menggunakan resource yang dipesan, Anda tidak akan dikenai biaya tambahan. Anda hanya membayar resource yang bukan bagian dari reservasi, seperti alamat IP.
Batasan
Semua jenis reservasi memiliki batasan berikut:
Reservasi adalah resource khusus zona.
Anda tidak dapat menggunakan kapasitas yang dipesan untuk membuat resource Compute Engine berikut:
Instance komputasi dengan jenis mesin
f1-microataug1-smallVM flex-start
Sole-tenant node
Spot VM atau instance preemptible
Pilih jenis reservasi
Diagram berikut membantu Anda memilih jenis reservasi yang paling sesuai dengan persyaratan workload Anda. Jika Anda ingin membandingkan fitur di berbagai jenis reservasi, lihat tabel perbandingan dalam dokumen ini.
Pertanyaan dalam diagram sebelumnya adalah sebagai berikut:
Apakah Anda membutuhkan kapasitas segera?
Ya: lanjutkan ke pertanyaan berikutnya.
Tidak: lewati ke pertanyaan 3.
Apakah Anda memerlukan fleksibilitas dalam berapa lama kapasitas harus dipertahankan?
Ya: lihat Menggunakan reservasi on-demand.
Tidak: lanjutkan ke pertanyaan berikutnya.
Apakah Anda memerlukan resource yang banyak diminati seperti GPU?
Ya: lanjutkan ke pertanyaan berikutnya.
Tidak: lihat Menggunakan pemesanan untuk masa mendatang.
Apakah Anda memerlukan resource selama lebih dari 90 hari?
Menggunakan reservasi on-demand
Dengan reservasi on-demand, Anda meminta untuk memesan vCPU, memori, dan resource terlampir (GPU, TPU, dan disk SSD Lokal) untuk membuat instance komputasi. Jika permintaan Anda berhasil, Compute Engine akan melakukan hal berikut:
Compute Engine membuat pemesanan on-demand dengan resource yang Anda minta dalam beberapa menit.
Compute Engine mengalokasikan resource yang dipesan secara cermat berdasarkan upaya terbaik. Untuk menempatkan instance komputasi berdekatan guna meminimalkan latensi jaringan, Anda dapat secara opsional menentukan kebijakan penempatan rapat saat membuat pemesanan.
Untuk menggunakan reservasi, buat instance Compute yang cocok dengan properti reservasi dan menggunakan model penyediaan standar. Anda dapat menggunakan, mengubah, atau menghapus reservasi kapan saja.
Untuk mengetahui informasi selengkapnya, lihat Tentang reservasi.
Menggunakan pemesanan untuk masa mendatang
Dengan reservasi untuk masa mendatang, Anda meminta untuk memesan vCPU, memori, dan resource terlampir (GPU, TPU, dan disk SSD Lokal) untuk membuat instance komputasi pada tanggal dan waktu di masa mendatang. Setelah membuat permintaan reservasi, Anda mengirimkan permintaan ke Cloud de Confiance by S3NS untuk ditinjau. Jika Cloud de Confiance menyetujui permintaan Anda, Compute Engine akan melakukan hal berikut:
Compute Engine membuat pemesanan on-demand dengan kapasitas yang Anda minta pada tanggal dan waktu pengiriman yang Anda pilih.
Compute Engine mengalokasikan resource yang dipesan secara cermat berdasarkan upaya terbaik.
Untuk menggunakan reservasi, buat instance Compute yang cocok dengan properti reservasi dan menggunakan model penyediaan standar. Anda dapat mengubah atau menghapus reservasi kapan saja. Semua instance komputasi yang Anda buat menggunakan reservasi akan terus berjalan meskipun periode reservasi berakhir atau Anda menghapusnya.
Untuk mengetahui informasi selengkapnya, lihat Tentang permintaan pemesanan untuk masa mendatang.
Menggunakan pemesanan untuk masa mendatang dalam mode kalender
Dengan pemesanan mendatang dalam mode kalender, Anda dapat meminta untuk memesan vCPU, memori, dan resource terlampir (GPU, TPU, dan disk SSD Lokal) untuk tanggal dan waktu mendatang, dan hingga 90 hari. Untuk membuat jenis reservasi ini, Anda harus melihat terlebih dahulu kapan jumlah dan jenis resource yang Anda pilih tersedia di suatu region. Kemudian, Anda membuat dan mengirimkan permintaan pemesanan dengan properti yang telah Anda konfirmasi ketersediaannya. Jika Anda mengirimkan permintaan yang valid, maka Cloud de Confiance menyetujui permintaan tersebut dalam waktu satu menit. Setelah Cloud de Confiance menyetujui permintaan, Compute Engine akan melakukan hal berikut:
Compute Engine akan membuat pemesanan on-demand pada tanggal dan waktu pengiriman yang Anda pilih.
Compute Engine mencadangkan resource yang Anda minta dalam kedekatan fisik untuk meminimalkan latensi jaringan, yang berguna untuk workload kecerdasan buatan (AI), machine learning (ML), atau komputasi berperforma tinggi (HPC) yang saling terkait erat.
Compute Engine mencadangkan resource dengan kemampuan pengelolaan cluster, yang optimal untuk workload multi-node berskala besar.
Untuk menggunakan reservasi di awal periode reservasi, buat instance GPU, H4D, atau TPU yang cocok dengan properti reservasi dan dengan menggunakan model penyediaan terikat reservasi. Di akhir periode reservasi, Compute Engine akan menghapus reservasi, dan menghentikan atau menghapus instance komputasi yang menggunakan reservasi berdasarkan tindakan penghentian yang Anda tentukan untuk instance komputasi.
Untuk mengetahui informasi selengkapnya, lihat Tentang permintaan pemesanan untuk masa mendatang dalam mode kalender.
Menggunakan pemesanan untuk masa mendatang untuk blok kapasitas
Dengan pemesanan untuk masa mendatang untuk blok kapasitas, Anda dapat meminta untuk memesan vCPU, memori, dan resource terlampir (GPU, TPU, disk SSD Lokal, dan kumpulan Hyperdisk) untuk tanggal dan waktu mendatang, serta untuk durasi yang tidak terbatas. Untuk membuat jenis reservasi ini, hubungi tim akun Anda dan minta kapasitas. Setelah Google membuat draf permintaan pemesanan untuk Anda, Anda akan meninjau dan mengirimkan permintaan tersebut. Cloud de Confiance menyetujui permintaan tersebut dalam beberapa menit, lalu Compute Engine akan melakukan hal berikut:
Compute Engine membuat pemesanan sesuai permintaan pada tanggal dan waktu pengiriman yang Anda pilih.
Compute Engine mencadangkan resource yang Anda minta dalam jarak fisik yang dekat untuk meminimalkan latensi jaringan, yang berguna untuk workload AI, ML, atau HPC yang saling terkait erat.
Compute Engine mencadangkan resource dengan kemampuan pengelolaan cluster, yang optimal untuk workload multi-node berskala besar.
Untuk menggunakan reservasi di awal periode reservasi, buat instance GPU, TPU, atau H4D yang cocok dengan properti reservasi dan dengan menggunakan model penyediaan terikat reservasi. Di akhir periode reservasi, Compute Engine akan menghapus reservasi, dan menghentikan atau menghapus instance komputasi yang menggunakan reservasi berdasarkan tindakan penghentian yang Anda tetapkan untuk instance komputasi.
Untuk mengetahui informasi selengkapnya, lihat salah satu dokumen berikut:
Untuk instance GPU:
Untuk memesan kapasitas instance A4X Max, A4X, A4, A3 Ultra, A3 Mega, A3 High (8 GPU), atau A3 Edge untuk membuat instance komputasi atau cluster di Cluster Toolkit, Compute Engine, atau Google Kubernetes Engine (GKE), lihat Pesan kapasitas melalui tim akun Anda dalam dokumentasi AI Hypercomputer.
Untuk mencadangkan kapasitas instance A4X, A4, A3 Ultra, atau A3 Mega guna membuat cluster di Cluster Director, lihat Mencadangkan kapasitas melalui tim akun Anda dalam dokumentasi Cluster Director.
Untuk instance TPU:
- Untuk memesan kapasitas untuk instance TPU7x, TPU v6e, atau TPU v5p, lihat Meminta pemesanan untuk masa mendatang selama satu tahun atau lebih dalam dokumentasi Cloud TPU.
Untuk instance H4D:
- Untuk memesan kapasitas instance H4D, lihat Pesan kapasitas melalui tim akun Anda dalam dokumentasi Compute Engine.
Membandingkan jenis reservasi
Untuk mengidentifikasi jenis reservasi yang sesuai dengan beban kerja Anda, bandingkan kemampuan teknis di berbagai jenis reservasi dalam tabel berikut:
| Pemesanan sesuai permintaan | Pemesanan untuk masa mendatang | Pemesanan untuk masa mendatang dalam mode kalender | Pemesanan untuk masa mendatang untuk blok kapasitas | |
|---|---|---|---|---|
| Seri mesin yang didukung | Semua kelompok mesin (kecuali A4X Max, A4X, A4, A3 Ultra, dan A3 High dengan kurang dari 8 GPU) | A3 Mega*, A3 High (dengan 8 GPU)*, A3 Edge*, C4, C4A, C4D, C4N, C3, C3D, G4*, H4D*, H3, M4, M4N, M3, N4, N4A, N4D, TPU7x, TPU v6e, TPU v5p, X5, X4, Z4D, dan Z3 | A4, A3 Ultra, A3 Mega, A3 High (8 GPU), A3 Edge, H4D, TPU7x, TPU v6e, dan TPU v5p | A4X Max, A4X, A4, A3 Ultra, A3 Mega, A3 High (8 GPU), A3 Edge, H4D, TPU7x, TPU v6e, dan TPU v5p |
| Pemesanan penyimpanan | Tidak | Tidak | Tidak | Opsional (Kumpulan Hyperdisk) |
| Jumlah maksimum instance komputasi per permintaan | 1.000‡ | Tanpa batas# | 80 untuk instance GPU, 256 untuk instance H4D, dan 1.024 untuk chip TPU | Tanpa batas# |
| Durasi maksimum | Tanpa batas (hingga Anda menghapusnya) | Tanpa batas (hingga Anda menghapusnya) | Hingga 90 hari | Tidak terbatas (periode kontrak) |
| Melihat ketersediaan pada masa mendatang | Tidak | Tidak | Ya (hingga 60 hari untuk instance GPU dan H4D; hingga 120 hari untuk chip TPU) | Ya (hubungi tim akun Anda) |
| Metode pembuatan | Anda membuat reservasi | Anda membuat permintaan reservasi | Anda membuat permintaan reservasi | Anda menghubungi tim akun Anda, lalu Google akan membuat permintaan reservasi untuk Anda |
| Waktu pengiriman | Segera | Tanggal dan waktu tertentu di masa mendatang | Tanggal dan waktu tertentu di masa mendatang | Tanggal dan waktu tertentu di masa mendatang |
| Alokasi resource | Upaya terbaik (opsional kebijakan penempatan rapat) | Upaya terbaik | Padat | Padat |
| Kemampuan pengelolaan cluster | Tidak | Tidak | Ya | Ya |
| Model penyediaan | Standar | Standar | Terikat dengan reservasi | Terikat dengan reservasi |
| Kuota | Memerlukan kuota standar | Memerlukan kuota standar | Tidak memerlukan kuota untuk instance GPU atau chip TPU; memerlukan kuota standar untuk instance H4D | Google akan otomatis menaikkan kuota Anda sebelum pengiriman |
| Harga | Harga standar (diskon dengan komitmen) | Harga standar (diskon dengan komitmen) | Diskon hingga 53% (harga DWS) | Harga standar (diskon dengan komitmen) |
| Akhir periode pemesanan | Penghapusan manual | Penghapusan manual | Penghapusan pemesanan otomatis; instance komputasi berhenti atau dihapus berdasarkan tindakan penghentiannya | Penghapusan otomatis kumpulan Hyperdisk dan reservasi; instance komputasi berhenti atau dihapus berdasarkan tindakan penghentiannya |
* Sebelum mengirimkan permintaan pemesanan untuk masa mendatang untuk instance A3 Mega, A3 High (dengan 8 GPU), A3 Edge, G4, atau H4D, Anda harus menghubungi tim akun atau tim penjualan. Jika tidak, Cloud de Confiance kemungkinan akan menolak permintaan Anda.
‡ Jika Anda menerapkan kebijakan penempatan rapat dengan nilai jarak maksimum 2 ke pemesanan on-demand, Anda dapat memesan maksimum 256 instance A3 Mega, A3 High dengan 8 GPU, atau A3 Edge, atau maksimum 150 instance komputasi untuk semua kelompok mesin lain yang didukung. Untuk mengetahui informasi selengkapnya, lihat bagian
Tentang kebijakan penempatan rapat.
# Jika Anda meminta untuk memesan lebih dari 1.000 instance komputasi dalam satu permintaan pemesanan, Compute Engine akan menyediakan kapasitas yang Anda minta dengan membuat beberapa pemesanan on-demand pada tanggal dan waktu pengiriman yang Anda pilih.