Pilih jenis reservasi

Dokumen ini menjelaskan jenis reservasi yang dapat Anda gunakan untuk memesan kapasitas guna membuat instance Compute Engine. Untuk mempelajari lebih lanjut resource yang Anda butuhkan untuk membuat instance komputasi, lihat Instance Compute Engine.

Pemesanan memberikan jaminan yang sangat tinggi bagi project Anda bahwa resource zona tersedia saat Anda membutuhkannya untuk membuat instance komputasi. Anda dapat memesan hardware inti (vCPU dan memori) serta resource terlampir (GPU, TPU, disk SSD Lokal, dan kumpulan Hyperdisk). Jika Anda membagikan reservasi, hingga 100 project di organisasi Cloud de Confiance by S3NS Anda akan mendapatkan jaminan kapasitas yang sama. Anda dapat menggunakan resource yang dipesan kapan saja untuk membuat instance komputasi dengan properti yang cocok dengan reservasi Anda.

Pemesanan menawarkan manfaat berikut:

  • Jaminan kapasitas tinggi: Anda menyimpan resource di zona tertentu untuk mempersiapkan peningkatan permintaan pada masa mendatang, seperti pertumbuhan, lonjakan traffic, migrasi database besar, atau pemulihan dari bencana.

  • Akses eksklusif: Anda membatasi akses ke resource yang dicadangkan sehingga project lain, baik di dalam maupun di luar organisasi Anda Cloud de Confiance, tidak dapat menggunakannya. Membatasi akses membantu memastikan bahwa workload Anda memiliki resource yang diperlukan untuk dijalankan.

  • Retensi kapasitas: Anda mempertahankan vCPU, memori, GPU, TPU, disk SSD Lokal, dan kapasitas penyimpanan (jika disertakan dalam reservasi Anda) meskipun Anda menghentikan instance komputasi. Kemudian, Anda dapat memulai ulang instance komputasi tersebut tanpa mengalami error ketersediaan resource.

  • Konfigurasi yang konsisten: instance komputasi yang Anda buat dengan menggunakan resource yang dicadangkan memiliki penyiapan hardware dan penyimpanan yang identik. Pendekatan ini membantu memastikan performa yang konsisten dan menghindari penundaan pemrosesan di seluruh instance komputasi Anda.

Setelah Compute Engine menyediakan resource yang dipesan, Anda akan membayar resource tersebut, terlepas dari apakah Anda menggunakannya atau tidak, dan selama pemesanan masih ada. Saat membuat instance komputasi dengan menggunakan resource yang dipesan, Anda tidak akan dikenai biaya tambahan. Anda hanya membayar resource yang bukan bagian dari reservasi, seperti alamat IP.

Batasan

Semua jenis reservasi memiliki batasan berikut:

  • Reservasi adalah resource khusus zona.

  • Anda tidak dapat menggunakan kapasitas yang dipesan untuk membuat resource Compute Engine berikut:

    • Instance komputasi dengan jenis mesin f1-micro atau g1-small

    • VM flex-start

    • Sole-tenant node

    • Spot VM atau instance preemptible

Pilih jenis reservasi

Diagram berikut membantu Anda memilih jenis reservasi yang paling sesuai dengan persyaratan workload Anda. Jika Anda ingin membandingkan fitur di berbagai jenis reservasi, lihat tabel perbandingan dalam dokumen ini.

Diagram alur dengan berbagai metode reservasi yang tersedia di Compute Engine.

Pertanyaan dalam diagram sebelumnya adalah sebagai berikut:

  1. Apakah Anda membutuhkan kapasitas segera?

    • Ya: lanjutkan ke pertanyaan berikutnya.

    • Tidak: lewati ke pertanyaan 3.

  2. Apakah Anda memerlukan fleksibilitas dalam berapa lama kapasitas harus dipertahankan?

  3. Apakah Anda memerlukan resource yang banyak diminati seperti GPU?

  4. Apakah Anda memerlukan resource selama lebih dari 90 hari?

Menggunakan reservasi on-demand

Dengan reservasi on-demand, Anda meminta untuk memesan vCPU, memori, dan resource terlampir (GPU, TPU, dan disk SSD Lokal) untuk membuat instance komputasi. Jika permintaan Anda berhasil, Compute Engine akan melakukan hal berikut:

  • Compute Engine membuat pemesanan on-demand dengan resource yang Anda minta dalam beberapa menit.

  • Compute Engine mengalokasikan resource yang dipesan secara cermat berdasarkan upaya terbaik. Untuk menempatkan instance komputasi berdekatan guna meminimalkan latensi jaringan, Anda dapat secara opsional menentukan kebijakan penempatan rapat saat membuat pemesanan.

Untuk menggunakan reservasi, buat instance Compute yang cocok dengan properti reservasi dan menggunakan model penyediaan standar. Anda dapat menggunakan, mengubah, atau menghapus reservasi kapan saja.

Untuk mengetahui informasi selengkapnya, lihat Tentang reservasi.

Menggunakan pemesanan untuk masa mendatang

Dengan reservasi untuk masa mendatang, Anda meminta untuk memesan vCPU, memori, dan resource terlampir (GPU, TPU, dan disk SSD Lokal) untuk membuat instance komputasi pada tanggal dan waktu di masa mendatang. Setelah membuat permintaan reservasi, Anda mengirimkan permintaan ke Cloud de Confiance by S3NS untuk ditinjau. Jika Cloud de Confiance menyetujui permintaan Anda, Compute Engine akan melakukan hal berikut:

  • Compute Engine membuat pemesanan on-demand dengan kapasitas yang Anda minta pada tanggal dan waktu pengiriman yang Anda pilih.

  • Compute Engine mengalokasikan resource yang dipesan secara cermat berdasarkan upaya terbaik.

Untuk menggunakan reservasi, buat instance Compute yang cocok dengan properti reservasi dan menggunakan model penyediaan standar. Anda dapat mengubah atau menghapus reservasi kapan saja. Semua instance komputasi yang Anda buat menggunakan reservasi akan terus berjalan meskipun periode reservasi berakhir atau Anda menghapusnya.

Untuk mengetahui informasi selengkapnya, lihat Tentang permintaan pemesanan untuk masa mendatang.

Menggunakan pemesanan untuk masa mendatang dalam mode kalender

Dengan pemesanan mendatang dalam mode kalender, Anda dapat meminta untuk memesan vCPU, memori, dan resource terlampir (GPU, TPU, dan disk SSD Lokal) untuk tanggal dan waktu mendatang, dan hingga 90 hari. Untuk membuat jenis reservasi ini, Anda harus melihat terlebih dahulu kapan jumlah dan jenis resource yang Anda pilih tersedia di suatu region. Kemudian, Anda membuat dan mengirimkan permintaan pemesanan dengan properti yang telah Anda konfirmasi ketersediaannya. Jika Anda mengirimkan permintaan yang valid, maka Cloud de Confiance menyetujui permintaan tersebut dalam waktu satu menit. Setelah Cloud de Confiance menyetujui permintaan, Compute Engine akan melakukan hal berikut:

  • Compute Engine akan membuat pemesanan on-demand pada tanggal dan waktu pengiriman yang Anda pilih.

  • Compute Engine mencadangkan resource yang Anda minta dalam kedekatan fisik untuk meminimalkan latensi jaringan, yang berguna untuk workload kecerdasan buatan (AI), machine learning (ML), atau komputasi berperforma tinggi (HPC) yang saling terkait erat.

  • Compute Engine mencadangkan resource dengan kemampuan pengelolaan cluster, yang optimal untuk workload multi-node berskala besar.

Untuk menggunakan reservasi di awal periode reservasi, buat instance GPU, H4D, atau TPU yang cocok dengan properti reservasi dan dengan menggunakan model penyediaan terikat reservasi. Di akhir periode reservasi, Compute Engine akan menghapus reservasi, dan menghentikan atau menghapus instance komputasi yang menggunakan reservasi berdasarkan tindakan penghentian yang Anda tentukan untuk instance komputasi.

Untuk mengetahui informasi selengkapnya, lihat Tentang permintaan pemesanan untuk masa mendatang dalam mode kalender.

Menggunakan pemesanan untuk masa mendatang untuk blok kapasitas

Dengan pemesanan untuk masa mendatang untuk blok kapasitas, Anda dapat meminta untuk memesan vCPU, memori, dan resource terlampir (GPU, TPU, disk SSD Lokal, dan kumpulan Hyperdisk) untuk tanggal dan waktu mendatang, serta untuk durasi yang tidak terbatas. Untuk membuat jenis reservasi ini, hubungi tim akun Anda dan minta kapasitas. Setelah Google membuat draf permintaan pemesanan untuk Anda, Anda akan meninjau dan mengirimkan permintaan tersebut. Cloud de Confiance menyetujui permintaan tersebut dalam beberapa menit, lalu Compute Engine akan melakukan hal berikut:

  • Compute Engine membuat pemesanan sesuai permintaan pada tanggal dan waktu pengiriman yang Anda pilih.

  • Compute Engine mencadangkan resource yang Anda minta dalam jarak fisik yang dekat untuk meminimalkan latensi jaringan, yang berguna untuk workload AI, ML, atau HPC yang saling terkait erat.

  • Compute Engine mencadangkan resource dengan kemampuan pengelolaan cluster, yang optimal untuk workload multi-node berskala besar.

Untuk menggunakan reservasi di awal periode reservasi, buat instance GPU, TPU, atau H4D yang cocok dengan properti reservasi dan dengan menggunakan model penyediaan terikat reservasi. Di akhir periode reservasi, Compute Engine akan menghapus reservasi, dan menghentikan atau menghapus instance komputasi yang menggunakan reservasi berdasarkan tindakan penghentian yang Anda tetapkan untuk instance komputasi.

Untuk mengetahui informasi selengkapnya, lihat salah satu dokumen berikut:

Membandingkan jenis reservasi

Untuk mengidentifikasi jenis reservasi yang sesuai dengan beban kerja Anda, bandingkan kemampuan teknis di berbagai jenis reservasi dalam tabel berikut:

Pemesanan sesuai permintaan Pemesanan untuk masa mendatang Pemesanan untuk masa mendatang dalam mode kalender Pemesanan untuk masa mendatang untuk blok kapasitas
Seri mesin yang didukung Semua kelompok mesin (kecuali A4X Max, A4X, A4, A3 Ultra, dan A3 High dengan kurang dari 8 GPU) A3 Mega*, A3 High (dengan 8 GPU)*, A3 Edge*, C4, C4A, C4D, C4N, C3, C3D, G4*, H4D*, H3, M4, M4N, M3, N4, N4A, N4D, TPU7x, TPU v6e, TPU v5p, X5, X4, Z4D, dan Z3 A4, A3 Ultra, A3 Mega, A3 High (8 GPU), A3 Edge, H4D, TPU7x, TPU v6e, dan TPU v5p A4X Max, A4X, A4, A3 Ultra, A3 Mega, A3 High (8 GPU), A3 Edge, H4D, TPU7x, TPU v6e, dan TPU v5p
Pemesanan penyimpanan Tidak Tidak Tidak Opsional (Kumpulan Hyperdisk)
Jumlah maksimum instance komputasi per permintaan 1.000‡ Tanpa batas# 80 untuk instance GPU, 256 untuk instance H4D, dan 1.024 untuk chip TPU Tanpa batas#
Durasi maksimum Tanpa batas (hingga Anda menghapusnya) Tanpa batas (hingga Anda menghapusnya) Hingga 90 hari Tidak terbatas (periode kontrak)
Melihat ketersediaan pada masa mendatang Tidak Tidak Ya (hingga 60 hari untuk instance GPU dan H4D; hingga 120 hari untuk chip TPU) Ya (hubungi tim akun Anda)
Metode pembuatan Anda membuat reservasi Anda membuat permintaan reservasi Anda membuat permintaan reservasi Anda menghubungi tim akun Anda, lalu Google akan membuat permintaan reservasi untuk Anda
Waktu pengiriman Segera Tanggal dan waktu tertentu di masa mendatang Tanggal dan waktu tertentu di masa mendatang Tanggal dan waktu tertentu di masa mendatang
Alokasi resource Upaya terbaik (opsional kebijakan penempatan rapat) Upaya terbaik Padat Padat
Kemampuan pengelolaan cluster Tidak Tidak Ya Ya
Model penyediaan Standar Standar Terikat dengan reservasi Terikat dengan reservasi
Kuota Memerlukan kuota standar Memerlukan kuota standar Tidak memerlukan kuota untuk instance GPU atau chip TPU; memerlukan kuota standar untuk instance H4D Google akan otomatis menaikkan kuota Anda sebelum pengiriman
Harga Harga standar (diskon dengan komitmen) Harga standar (diskon dengan komitmen) Diskon hingga 53% (harga DWS) Harga standar (diskon dengan komitmen)
Akhir periode pemesanan Penghapusan manual Penghapusan manual Penghapusan pemesanan otomatis; instance komputasi berhenti atau dihapus berdasarkan tindakan penghentiannya Penghapusan otomatis kumpulan Hyperdisk dan reservasi; instance komputasi berhenti atau dihapus berdasarkan tindakan penghentiannya

* Sebelum mengirimkan permintaan pemesanan untuk masa mendatang untuk instance A3 Mega, A3 High (dengan 8 GPU), A3 Edge, G4, atau H4D, Anda harus menghubungi tim akun atau tim penjualan. Jika tidak, Cloud de Confiance kemungkinan akan menolak permintaan Anda.

‡ Jika Anda menerapkan kebijakan penempatan rapat dengan nilai jarak maksimum 2 ke pemesanan on-demand, Anda dapat memesan maksimum 256 instance A3 Mega, A3 High dengan 8 GPU, atau A3 Edge, atau maksimum 150 instance komputasi untuk semua kelompok mesin lain yang didukung. Untuk mengetahui informasi selengkapnya, lihat bagian Tentang kebijakan penempatan rapat.

# Jika Anda meminta untuk memesan lebih dari 1.000 instance komputasi dalam satu permintaan pemesanan, Compute Engine akan menyediakan kapasitas yang Anda minta dengan membuat beberapa pemesanan on-demand pada tanggal dan waktu pengiriman yang Anda pilih.