Mengonfigurasi workload Anda agar mengandalkan satu jenis atau zona mesin dapat membatasi kemampuan Anda untuk mengakses resource yang tersedia selama lonjakan permintaan. Untuk mengoptimalkan penyediaan komputasi dan membantu menjaga workload Anda tetap berjalan selama lonjakan permintaan, Anda harus mendesain infrastruktur Compute Engine yang fleksibel. Fleksibilitas infrastruktur memungkinkan Anda menentukan beberapa zona, jenis mesin, atau waktu mulai, bukan satu konfigurasi tetap. Compute Engine secara otomatis memilih dari opsi pilihan Anda, sehingga membantu Anda memaksimalkan ketersediaan resource, meningkatkan harga-performa, dan mengadopsi hardware terbaru dengan aman.
Dokumen ini menjelaskan dimensi fleksibilitas infrastruktur, manfaatnya, dan cara memilih pendekatan yang tepat untuk workload Anda. Dokumen ini juga menjelaskan fitur Compute Engine yang relevan, pertimbangan desain, dan langkah-langkah untuk adopsi. Dokumen ini ditujukan bagi arsitek solusi, operator infrastruktur, dan engineer cloud yang mendesain atau mengelola infrastruktur komputasi.
Fleksibilitas infrastruktur
Anda dapat mendesain fleksibilitas infrastruktur di tiga dimensi berikut:
Fleksibilitas lokasi (di mana): sebarkan instance Compute Engine di beberapa zona dalam satu region untuk memaksimalkan akses ke resource yang tersedia, atau pilih satu zona secara otomatis dengan kapasitas yang tersedia untuk workload yang sensitif terhadap latensi.
Fleksibilitas jenis mesin (apa): tentukan daftar jenis mesin yang kompatibel dan diberi peringkat, sehingga beban kerja Anda dapat menggunakan alternatif jika diperlukan.
Fleksibilitas waktu (kapan): mengantrekan permintaan untuk resource yang sangat diminati, seperti akselerator, alih-alih memerlukan penyediaan langsung untuk workload yang tidak perlu segera dimulai.
Manfaat infrastruktur yang fleksibel
Mengadopsi infrastruktur Compute Engine yang fleksibel memberikan manfaat berikut:
Mengotomatiskan pengelolaan kapasitas selama lonjakan permintaan. Workload Anda secara otomatis menemukan dan menggunakan resource di beberapa jenis mesin dan zona. Pendekatan ini membantu memastikan bahwa permintaan penskalaan Anda berhasil, meskipun hardware pilihan Anda tidak tersedia untuk sementara.
Menyederhanakan pengelolaan kapasitas. Anda dapat mengurangi biaya operasional pencarian manual untuk hardware yang tersedia. Compute Engine secara otomatis mengalihkan permintaan Anda berdasarkan preferensi penggantian Anda, sehingga mengurangi hambatan operasional.
Mengurangi risiko kapasitas selama transisi ke hardware terbaru. Anda dapat mengonfigurasi deployment untuk memprioritaskan generasi hardware terbaru dan mempertahankan generasi lama sebagai penggantian respons. Setelan ini membuat adopsi mesin terbaru dan yang sangat diminati menjadi lebih tidak berisiko karena jika mesin terbaru tidak tersedia, deployment Anda tetap dapat meminta kapasitas secara otomatis untuk mesin yang lebih lama.
Mengoptimalkan biaya untuk traffic dasar dan puncak. Anda dapat mencadangkan kapasitas hanya untuk traffic dasar yang diketahui dan menggunakan penggantian jenis mesin untuk menangani lonjakan yang tidak terduga. Pendekatan ini mengurangi biaya kapasitas pencadangan saat tidak ada aktivitas. Anda juga dapat mempertahankan cakupan diskon di seluruh seri mesin dan region dengan menggunakan diskon abonemen (DA) fleksibel komputasi, yang mencegah harga on-demand saat workload Anda beralih seri mesin atau region.
Perbandingan dimensi fleksibilitas
Anda dapat menggabungkan fleksibilitas lokasi dengan fleksibilitas jenis mesin atau waktu. Namun, fleksibilitas jenis mesin dan fleksibilitas waktu tidak kompatibel dalam satu deployment. Anda harus memilih antara opsi penggantian hardware atau menunggu dalam antrean hingga resource tersedia.
Untuk membantu Anda mengevaluasi opsi ini, tabel berikut membandingkan cara kerja setiap dimensi fleksibilitas. Untuk mendapatkan panduan tentang pendekatan mana yang sesuai dengan kasus penggunaan spesifik Anda, lihat Kesesuaian dan rekomendasi workload.
| Fleksibilitas lokasi (di mana) | Fleksibilitas jenis mesin (apa) | Fleksibilitas waktu (kapan) | |
|---|---|---|---|
| Cara meningkatkan ketersediaan | Memaksimalkan akses ke resource yang tersedia di beberapa zona dalam satu region. | Mengurangi kemungkinan terjadinya error resource tidak tersedia dengan melakukan pengembalian ke jenis mesin alternatif yang kompatibel. | Mendapatkan resource dengan permintaan tinggi dengan menempatkan permintaan dalam antrean untuk menunggu ketersediaan kapasitas. |
| Linimasa penyediaan | Segera | Segera | Dalam antrean |
| Metode penyediaan | Menyediakan instance komputasi berdasarkan ketersediaan di seluruh zona yang dipilih. | Menyediakan instance komputasi berdasarkan ketersediaan di seluruh jenis mesin yang dipilih. | Menyediakan instance komputasi saat semua kapasitas yang diminta tersedia. |
| Dukungan jenis mesin | Mendukung satu atau beberapa jenis mesin di seluruh zona. | Menggunakan beberapa jenis mesin. | Hanya mendukung satu jenis mesin. |
Kesesuaian dan rekomendasi workload
Penerapan fleksibilitas infrastruktur bergantung pada arsitektur dan persyaratan performa workload Anda. Untuk membantu Anda memilih pendekatan terbaik, tabel berikut merangkum dimensi dan konfigurasi fleksibilitas yang direkomendasikan untuk beberapa jenis workload umum.
| Jenis workload | Rekomendasi fleksibilitas |
|---|---|
| Pemrosesan batch stateless, Komputasi throughput tinggi (HTC) yang tidak terikat |
Fleksibilitas lokasi dan jenis mesin: gunakan kebijakan fleksibilitas instance dengan salah satu opsi berikut:
Pendekatan ini memungkinkan workload Anda diskalakan di berbagai zona dan jenis mesin untuk memaksimalkan ketersediaan resource. |
| Pelatihan, penyesuaian, dan tugas batch skala besar AI/ML | Fleksibilitas waktu: gunakan model penyediaan yang menggunakan Dynamic Workload Scheduler (DWS). Pendekatan ini meningkatkan akses ke resource dengan permintaan tinggi, seperti akselerator, dengan menempatkan permintaan dalam antrean, bukan memerlukan penyediaan langsung sesuai permintaan. |
| Microservice dan frontend web | Fleksibilitas lokasi dan jenis mesin: gunakan MIG regional dengan bentuk distribusi target BALANCED dan kebijakan fleksibilitas instance. Pilih jenis mesin dengan jumlah vCPU dan memori yang cocok untuk penskalaan otomatis yang dapat diprediksi. Selain itu, aktifkan update saat perbaikan agar instance komputasi yang dibuat ulang menggunakan konfigurasi fleksibilitas instance terbaru. |
| Database dengan ketersediaan tinggi | Fleksibilitas lokasi dan fleksibilitas jenis mesin:
gunakan MIG regional dengan bentuk distribusi target |
| Sistem yang sangat terikat latensi | Fleksibilitas lokasi: gunakan MIG regional dengan
bentuk distribusi ANY_SINGLE_ZONE. Bentuk ini memberikan
fleksibilitas lokasi dengan menelusuri semua zona di region untuk menemukan
kapasitas yang memadai, sekaligus memastikan semua instance ditempatkan dalam
zona yang sama untuk mempertahankan latensi rendah. |
Konfigurasi fleksibel dapat menimbulkan variasi hardware yang dapat memengaruhi performa aplikasi. Saat mendesain untuk fleksibilitas, evaluasi keseimbangan antara memaksimalkan ketersediaan resource dan mempertahankan performa yang konsisten. Untuk mendapatkan panduan, lihat bagian berikut tentang Mengevaluasi dan menerapkan infrastruktur fleksibel.
Fitur fleksibilitas inti di Compute Engine
Untuk mengotomatiskan pengelolaan kapasitas, Anda dapat menerapkan fleksibilitas di beberapa lapisan infrastruktur. Compute Engine menyediakan fitur yang memungkinkan fleksibilitas lokasi, jenis mesin, dan waktu. Anda dapat mengonfigurasi fitur ini secara terpisah atau menggabungkannya agar sesuai dengan persyaratan beban kerja Anda.
Fitur fleksibilitas lokasi
Fitur fleksibilitas lokasi memaksimalkan ketersediaan resource dengan mendistribusikan instance komputasi di beberapa zona dalam satu region. Untuk memaksimalkan manfaat ini, pilih region tempat jenis mesin pilihan Anda tersedia di semua zona.
Anda dapat menerapkan fleksibilitas lokasi ke jenis deployment berikut:
MIG: MIG regional mengevaluasi kapasitas real-time selama pembuatan dan pemeliharaan instance untuk menyediakan instance komputasi di tempat resource tersedia. Jika suatu zona tidak memiliki kapasitas selama perbaikan instance, MIG yang menggunakan bentuk
ANYatauBALANCEDdapat otomatis membuat ulang instance komputasi yang gagal di zona lain. Untuk mendapatkan hasil terbaik, konfigurasikan bentuk distribusi target berdasarkan tujuan workload Anda:ANY: direkomendasikan untuk ketersediaan maksimum. Gunakan bentuk ini untuk memaksimalkan ketersediaan resource. Bentuk ini mengalokasikan instance komputasi ke zona mana pun dengan kapasitas yang tersedia dan memprioritaskan reservasi yang tidak digunakan.BALANCED: direkomendasikan untuk ketersediaan tinggi. Gunakan bentuk ini untuk beban kerja HA. Kebijakan ini menyebarkan instance komputasi secara merata di seluruh zona untuk melindungi dari pemadaman layanan zona, sambil tetap memprioritaskan zona tempat resource tersedia.ANY_SINGLE_ZONE: direkomendasikan untuk latensi rendah. Gunakan bentuk ini untuk batas latensi yang ketat. Fitur ini mengalokasikan semua instance komputasi dalam MIG ke satu zona yang memiliki resource paling banyak yang tersedia.
Untuk mengetahui informasi selengkapnya, lihat Tentang MIG regional.
Grup instance tidak terkelola: grup ini tidak mendukung fleksibilitas lokasi secara native. Sebagai gantinya, buat instance komputasi secara massal menggunakan
regionInstances.bulkInsertAPI, yang dapat menyediakan hingga 5.000 instance komputasi mandiri, dengan bentuk distribusi targetANY_SINGLE_ZONE. Permintaan ini membuat instance komputasi dalam satu zona dan Anda dapat menambahkannya ke grup tidak terkelola. Perhatikan bahwa untuk instance komputasi mandiri, Compute Engine mengevaluasi kapasitas untuk memilih zona hanya selama permintaan pembuatan instance komputasi.Untuk mengetahui informasi selengkapnya, lihat Mengelompokkan VM yang tidak dikelola.
Instance komputasi mandiri: gunakan permintaan pembuatan instance massal regional (
regionInstances.bulkInsertAPI) dengan bentuk distribusi target (ANY,BALANCED, atauANY_SINGLE_ZONE) dan tetapkan jumlah minimum. Jumlah minimum memungkinkan permintaan Anda menyediakan sebanyak mungkin instance komputasi, bukan gagal sepenuhnya jika kapasitas penuh tidak segera tersedia. Untuk instance komputasi mandiri, Compute Engine mengevaluasi kapasitas untuk memilih zona hanya selama permintaan pembuatan instance.Untuk mengetahui informasi selengkapnya, lihat Tentang pembuatan VM secara massal.
Fitur fleksibilitas jenis mesin
Fitur fleksibilitas jenis mesin memungkinkan deployment Anda menggunakan daftar jenis mesin alternatif yang diprioritaskan. Jika pilihan utama Anda tidak tersedia, Compute Engine akan otomatis melakukan failover ke jenis mesin sekunder Anda. Anda mengonfigurasi kemampuan ini dengan menentukan kebijakan fleksibilitas instance, yang terdiri dari satu atau daftar berperingkat dari beberapa pilihan instance.
Anda dapat menerapkan kebijakan fleksibilitas instance ke jenis deployment berikut:
MIG: melampirkan kebijakan fleksibilitas instance ke MIG agar grup dapat otomatis melakukan failover ke hardware alternatif selama lonjakan permintaan. Jika MIG Anda menggunakan Spot VM, kebijakan ini akan otomatis memprioritaskan jenis mesin pengganti yang menawarkan perkiraan waktu aktif yang lebih lama dan risiko preempt yang lebih rendah. Untuk mengetahui informasi selengkapnya, lihat Tentang fleksibilitas instance di MIG.
Grup instance tidak terkelola: karena grup ini tidak mendukung kebijakan fleksibilitas instance secara native, Anda dapat menyediakan instance menggunakan API
regionInstances.bulkInsert, lalu menambahkannya ke grup Anda. Dalam permintaan API, sertakan kebijakan fleksibilitas instance, dan tentukan satu zona (locationPolicy.zones.zone) atau gunakan bentuk distribusi targetANY_SINGLE_ZONE. Menggunakan bentukANY_SINGLE_ZONEmemberikan manfaat tambahan berupa fleksibilitas lokasi dengan otomatis memilih zona yang memiliki resource paling banyak. Perhatikan bahwa untuk instance mandiri, Compute Engine menerapkan kebijakan fleksibilitas Anda hanya selama permintaan pembuatan instance.Untuk mengetahui informasi selengkapnya tentang cara membuat instance komputasi secara massal, lihat Membuat VM secara massal dengan fleksibilitas instance, dan untuk menambahkannya ke grup, lihat Mengelompokkan VM yang tidak dikelola.
Instance komputasi mandiri: untuk workload yang tidak memerlukan grup instance, seperti tugas pemrosesan batch independen, Anda dapat menggunakan API
regionInstances.bulkInsertdengan kebijakan fleksibilitas instance untuk menyediakan instance komputasi. Perhatikan bahwa untuk instance mandiri, Compute Engine menerapkan kebijakan fleksibilitas Anda hanya selama permintaan pembuatan instance.Untuk mengetahui informasi selengkapnya, lihat Tentang fleksibilitas instance untuk VM yang dibuat secara massal.
Menskalakan dengan lancar di berbagai jenis mesin
Saat Anda mengonfigurasi fleksibilitas jenis mesin, jenis mesin pengganti Anda mungkin memiliki arsitektur hardware atau spesifikasi disk yang berbeda. Jika spesifikasi tersebut tidak kompatibel untuk jenis mesin dalam pilihan instance, maka penyediaan dapat gagal.
Untuk menggunakan jenis mesin dengan spesifikasi yang tidak kompatibel, Anda harus menentukan penggantian properti dalam kebijakan fleksibilitas instance. Penggantian ini memastikan bahwa saat Compute Engine melakukan penggantian ke jenis mesin alternatif, Compute Engine akan otomatis menerapkan image boot, jenis disk, atau dasar prosesor yang benar yang diperlukan untuk hardware tertentu tersebut. Kemampuan ini memungkinkan deployment Anda diskalakan di berbagai jenis mesin dengan lancar dan peluang keberhasilan penyediaan yang lebih tinggi.
Untuk mengetahui informasi selengkapnya, lihat Cara kerja penggantian platform disk dan CPU.
Fitur fleksibilitas waktu
Fitur fleksibilitas waktu memungkinkan workload yang tidak perlu dimulai segera menunggu resource yang sangat diminati, seperti akselerator, daripada memerlukan penyediaan segera.
Untuk menerapkan fleksibilitas waktu, bergantung pada persyaratan beban kerja Anda, gunakan fitur berikut yang menggunakan DWS:
Untuk mengantrekan permintaan kapasitas hingga resource tersedia, gunakan model penyediaan flex-start.
Untuk memesan kapasitas di masa mendatang untuk tanggal dan waktu yang direncanakan tertentu, gunakan pemesanan untuk masa mendatang dalam mode kalender.
Mengevaluasi dan menerapkan infrastruktur yang fleksibel
Sebelum mengonfigurasi fleksibilitas lokasi atau jenis mesin, Anda harus memverifikasi bahwa lokasi dan jenis mesin yang Anda pilih kompatibel satu sama lain dan dengan persyaratan workload Anda. Untuk membantu Anda berhasil mendesain dan menerapkan infrastruktur yang fleksibel, bagian berikut memberikan pertimbangan evaluasi utama dan strategi adopsi inkremental.
Pertimbangan evaluasi
Beberapa pertimbangan utama untuk mengevaluasi infrastruktur yang fleksibel adalah sebagai berikut:
Fleksibilitas lokasi: mendistribusikan workload Anda di beberapa zona dapat memengaruhi latensi jaringan dan meningkatkan biaya transfer data lintas zona.
Untuk mempelajari lebih lanjut, lihat dokumen berikut:
- Untuk melihat data latensi untuk traffic di seluruh instance komputasi di zona, lihat Melihat dasbor latensi Cloud de Confiance .
- Untuk menghitung biaya transfer data yang terkait dengan traffic antar-zona, tinjau Harga transfer data VM-VM dalam Cloud de Confiance
Fleksibilitas jenis mesin: beralih ke jenis mesin alternatif dapat memperkenalkan variasi dalam performa dan biaya aplikasi. Fleksibilitas jenis mesin di berbagai generasi sering kali mengharuskan Anda menerapkan penggantian platform CPU dan disk. Anda harus memverifikasi bahwa jenis mesin yang ingin Anda gunakan memenuhi prasyarat teknis aplikasi Anda.
Untuk mempelajari lebih lanjut, lihat dokumen berikut:
- Untuk membandingkan spesifikasi di seluruh seri mesin, lihat Perbandingan seri mesin.
- Untuk melihat harga instance komputasi, lihat Harga mesin virtual.
Strategi adopsi
Bergantung pada apakah Anda mendesain deployment baru atau memigrasikan deployment yang sudah ada, pilih strategi yang sesuai sebagai berikut:
Untuk workload baru: jika Anda mendesain deployment baru, sebaiknya gunakan fleksibilitas dalam desain infrastruktur Anda. Untuk mengidentifikasi dimensi fleksibilitas yang direkomendasikan untuk jenis beban kerja Anda, ikuti panduan dalam Kesesuaian dan rekomendasi beban kerja. Kemudian, pilih jenis deployment yang paling mendukung workload Anda. Untuk mengetahui informasi selengkapnya tentang jenis deployment dan penyiapan fleksibilitasnya, lihat bagian Fitur fleksibilitas inti.
Untuk deployment yang sudah ada: jika Anda ingin memigrasikan deployment yang menggunakan satu zona atau jenis mesin ke infrastruktur yang fleksibel, sebaiknya terapkan fleksibilitas secara bertahap untuk meminimalkan risiko. Anda dapat menggunakan strategi adopsi inkremental seperti berikut:
Menambahkan fleksibilitas lokasi. Migrasikan workload zonal ke MIG regional dengan bentuk distribusi
BALANCEDatauANY. Jika Anda menggunakan MIG regional dengan bentukEVEN, ubah keBALANCED. Perubahan ini penting untuk MIG yang melakukan penskalaan. Batasan kapasitas sementara di zona tidak akan memblokir operasi penskalaan horizontal. Atau, jika Anda ingin membuat instance komputasi mandiri, gunakan APIregionInstances.bulkInsert.Tambahkan jenis mesin alternatif yang memiliki arsitektur yang sama. Lampirkan kebijakan fleksibilitas instance yang menentukan jenis mesin yang menggunakan arsitektur CPU dan dukungan disk yang sama—misalnya,
n2-standard-8dann2d-standard-8.Tambahkan jenis mesin alternatif dari generasi yang berbeda dan selaraskan CUD. Sertakan generasi mesin terbaru, seperti
n4-standard-8, dan gunakan penggantian disk sesuai kebutuhan. Selain itu, cakupan diskon untuk penggunaan pengganti dengan DA fleksibel Compute.
Untuk membantu memastikan penerapan yang aman dan berhasil untuk deployment baru dan migrasi inkremental, sebaiknya gunakan alur kerja peluncuran berikut:
Validasi dan tolok ukur. Uji aplikasi Anda di semua kombinasi disk dan zona serta family mesin yang dipilih di lingkungan non-produksi.
Produksi dan penskalaan. Luncurkan kebijakan fleksibilitas instance atau bentuk distribusi MIG regional secara bertahap ke sebagian kecil armada produksi Anda sebelum melakukan penskalaan secara global.
Pantau dan optimalkan. Pantau terus rasio penggantian, metrik performa, dan biaya untuk menyempurnakan daftar jenis mesin yang diprioritaskan. Saat menggunakan MIG, untuk melacak distribusi instance komputasi real-time di seluruh jenis mesin dan zona, gunakan dasbor pemantauan distribusi instance MIG. Untuk mengetahui petunjuknya, lihat Memantau distribusi instance di MIG.
Praktik terbaik
Untuk memaksimalkan efisiensi dan ketahanan infrastruktur fleksibel Anda, gunakan praktik terbaik yang dijelaskan di bagian berikut.
Praktik terbaik untuk fleksibilitas lokasi
Gunakan penempatan regional yang memperhatikan kapasitas. Deploy workload menggunakan MIG regional atau pembuatan VM massal regional. Pilih bentuk distribusi
BALANCEDatauANYkarena bentuk ini memungkinkan Compute Engine mengevaluasi kapasitas real-time di semua zona dalam region untuk menempatkan instance komputasi secara otomatis di tempat resource tersedia.Pilih region yang mendukung jenis mesin di beberapa zona: Deploy beban kerja di region tempat jenis mesin yang Anda pilih didukung di semua zona. Pendekatan ini memastikan bahwa fitur fleksibilitas lokasi memiliki jumlah maksimum zona alternatif untuk merutekan permintaan selama pembatasan kapasitas sementara. Untuk mengetahui daftar region dan zona, lihat Region dan zona yang tersedia.
Periksa ketersediaan untuk deployment Spot VM. Jika deployment Anda menggunakan Spot VM, periksa ketersediaan real-time dan perkiraan waktu aktif Spot VM di beberapa jenis dan lokasi mesin. Pilih region atau zona dengan kapasitas yang tersedia tinggi dan waktu aktif yang sesuai dengan workload Anda untuk mengurangi risiko penghentian. Untuk mengetahui informasi selengkapnya, lihat Melihat ketersediaan Spot VM (Pratinjau).
Praktik terbaik untuk fleksibilitas jenis mesin
Diversifikasi di seluruh kelompok mesin. Hindari kebijakan yang hanya berbeda berdasarkan inti CPU dalam satu keluarga—misalnya,
n2-standard-4dann2-standard-8. Batasan kapasitas yang dilokalkan dapat memengaruhi seluruh keluarga mesin secara bersamaan. Untuk meningkatkan ketersediaan, rentangkan beberapa generasi dan arsitektur mesin—misalnya,n4-standard-8dann2-standard-8.Menggunakan jenis mesin baru dengan jenis mesin lama sebagai pengganti. Gabungkan kelompok mesin terbaru ke dalam kebijakan fleksibilitas instance Anda bersama dengan kelompok lama untuk memaksimalkan ketersediaan.
Konfigurasi penggantian platform disk dan CPU. Mencampur jenis mesin dari generasi yang berbeda dapat melibatkan perbedaan pada disk dan platform CPU. Tentukan penggantian platform CPU dan disk dalam kebijakan fleksibilitas Anda untuk membantu memastikan infrastruktur Anda diskalakan di seluruh generasi mesin dengan lancar. Misalnya, konfigurasi Hyperdisk Balanced untuk instance N4 dan Persistent Disk untuk penggantian N2.
Prioritaskan jenis mesin yang lebih kecil. Bergantung pada kesesuaian workload, gunakan jenis mesin dengan vCPU dan memori yang lebih rendah. Misalnya, daripada mengandalkan satu jenis mesin seperti
n2-standard-64, evaluasi apakah beban kerja Anda dapat diskalakan di empat instance komputasi yang masing-masing menggunakan jenis mesinn2-standard-16. Jenis mesin yang lebih kecil umumnya memiliki ketersediaan sumber daya yang lebih tinggi.Pilih jenis mesin dengan performa serupa. Tentukan jenis mesin alternatif dengan ukuran vCPU dan memori yang serupa. Misalnya, gabungkan
n2d-standard-8,n4-standard-8, dann4a-standard-8dalam kebijakan fleksibilitas instance Anda. Pendekatan ini mempertahankan performa aplikasi yang konsisten sekaligus meningkatkan ketersediaan resource.Aktifkan update saat perbaikan di MIG. Secara default, MIG memperbaiki instance komputasi yang gagal menggunakan jenis mesin aslinya, yang dapat gagal jika hardware tersebut tidak tersedia untuk sementara. Aktifkan update saat reparasi sehingga reparasi secara otomatis di-roll back ke jenis mesin yang tersedia dalam kebijakan fleksibilitas Anda. Untuk mengetahui detailnya, lihat Fleksibilitas instance dan perbaikan VM.
Menggabungkan Spot VM dengan penggantian. Untuk workload yang fault-tolerant, gabungkan Spot VM dengan fleksibilitas jenis mesin dan lokasi. Jika Compute Engine mem-preempt Spot VM, fitur fleksibilitas ini memungkinkan deployment Anda secara otomatis mencari jenis mesin atau zona alternatif. Strategi ini membantu mempertahankan ketersediaan resource untuk workload Anda dengan biaya yang lebih rendah daripada penyediaan standar.
Praktik terbaik untuk fleksibilitas waktu
Menargetkan workload yang tepat. Menerapkan fleksibilitas waktu untuk workload yang memiliki waktu mulai fleksibel, tetapi memerlukan resource dengan permintaan tinggi seperti akselerator. Persyaratan ini mencakup pra-pelatihan model kecil, penyesuaian model, simulasi komputasi berperforma tinggi (HPC), dan inferensi batch.
Pilih fitur yang sesuai untuk linimasa Anda. Gunakan model penyediaan flex-start untuk mengantrekan permintaan untuk tugas berdurasi tertentu yang berjalan hingga tujuh hari. Untuk mendapatkan resource dengan permintaan tinggi hingga 90 hari atau lebih, gunakan model penyediaan terikat reservasi.
Mengoptimalkan waktu tunggu VM Flex-start. Saat Anda mencoba membuat VM Mulai fleksibel, tentukan waktu tunggu yang lebih lama jika workload Anda harus berjalan di zona tertentu. Menunggu lebih lama akan meningkatkan peluang Compute Engine dapat menyediakan resource yang Anda minta. Jika Anda ingin membuat VM Flex-start mandiri dan workload Anda dapat dimulai di zona mana pun dalam suatu region, tentukan waktu tunggu nol detik. Jika permintaan pembuatan gagal karena resource tidak tersedia, segera coba permintaan pembuatan di zona lain.
Menyesuaikan pemesanan dan diskon dengan fleksibilitas workload
Untuk menyeimbangkan ketersediaan dan biaya resource, sesuaikan diskon abonemen (CUD) dengan strategi kapasitas yang Anda pilih untuk workload Anda:
Penggunaan yang stabil di beberapa jenis mesin: jika workload Anda mendukung beberapa jenis mesin dan memiliki penggunaan yang stabil, konfigurasikan fleksibilitas jenis mesin dan gunakan CUD fleksibel komputasi. Fleksibilitas jenis mesin meningkatkan rasio keberhasilan penyediaan dengan menggunakan hardware alternatif saat pilihan utama Anda tidak memiliki kapasitas. DA fleksibel Compute adalah diskon berbasis pembelanjaan yang berlaku untuk pembelanjaan komputasi yang memenuhi syarat, terlepas dari rangkaian mesin spesifik yang disediakan Compute Engine.
Dasar pengukuran yang stabil dengan lonjakan traffic: jika workload Anda memiliki dasar pengukuran yang dapat diprediksi, tetapi dapat mengalami lonjakan yang tidak dapat diprediksi, amankan dasar pengukuran yang dapat diprediksi dengan reservasi dan DA berbasis resource. Untuk menangani lonjakan traffic, konfigurasikan fleksibilitas jenis mesin dan gunakan DA fleksibel komputasi untuk mencakup mesin penggantian alternatif. Dalam kebijakan fleksibilitas instance, tetapkan preferensi sebagai berikut:
Preferensi tertinggi: jenis mesin yang dicadangkan dengan DA berbasis resource
Preferensi yang lebih rendah: jenis mesin alternatif dan gunakan CUD yang fleksibel untuk komputasi
Compute Engine menggunakan komitmen berbasis resource Anda terlebih dahulu, lalu menggunakan komitmen fleksibel komputasi Anda untuk mencakup sisa penggunaan yang memenuhi syarat.
Workload hardware yang tetap ketat: jika workload Anda mengandalkan satu jenis mesin, gunakan reservasi dan DA berbasis resource. Reservasi memberikan jaminan kapasitas yang tinggi untuk hardware tertentu dan harus dipertimbangkan untuk workload yang sangat penting bagi bisnis. DA berbasis resource memberikan diskon untuk penggunaan yang stabil dan dapat diprediksi ini.
Untuk mengetahui informasi selengkapnya, lihat Memilih jenis reservasi, dan Diskon abonemen (CUD) untuk Compute Engine.
Pertimbangan desain untuk reservasi
Jika strategi Anda mencakup reservasi, tinjau pertimbangan desain berikut:
Prioritaskan jenis mesin yang dicadangkan. Jika Anda menggunakan reservasi dengan fleksibilitas jenis mesin, tambahkan jenis mesin yang dipesan ke preferensi tertinggi dalam kebijakan fleksibilitas instance. Konfigurasi ini membantu Compute Engine memprioritaskan pemesanan Anda daripada kapasitas on-demand.
Evaluasi cakupan reservasi Anda. Hindari membuat reservasi sebagai respons terhadap batasan kapasitas sementara. Jika beban kerja Anda menggunakan fleksibilitas lokasi, seperti MIG regional, Compute Engine dapat mendistribusikan instance ke zona lain di region. Reservasi zona yang ketat dalam skenario ini dapat menghasilkan resource tidak ada aktivitas yang tidak digunakan.
Batasan
Saat Anda mendesain infrastruktur yang fleksibel, batasan umum berikut berlaku. Untuk batasan yang lebih mendetail, lihat bagian Batasan di halaman fitur masing-masing.
Ketidakcocokan fitur: Anda tidak dapat menggabungkan fleksibilitas jenis mesin dan fleksibilitas waktu dalam satu deployment. Fitur yang memungkinkan fleksibilitas waktu hanya mendukung satu konfigurasi jenis mesin per permintaan.
Fleksibilitas selama pembuatan awal: untuk instance komputasi yang dibuat secara massal, evaluasi kapasitas dan kebijakan fleksibilitas instance hanya berlaku selama permintaan pembuatan instance komputasi awal. Instance komputasi yang dibuat secara massal tidak otomatis dialihkan ke zona atau jenis mesin alternatif selama perbaikan atau saat Anda menskalakan infrastruktur.
Men-deploy ke satu zona: MIG zona tidak mendukung fitur fleksibilitas dan tidak direkomendasikan. Untuk menerapkan fleksibilitas jenis mesin untuk desain zona tunggal, buat MIG regional dan pilih secara eksplisit hanya satu zona.
Langkah berikutnya
- Pelajari cara menggunakan MIG untuk menyebarkan VM di beberapa zona dalam satu region.
- Pelajari cara mengonfigurasi fleksibilitas instance di Grup Instance Terkelola.
- Pelajari cara membuat VM secara massal dengan fleksibilitas instance.
- Pelajari lebih lanjut DA di Compute Engine.