Mendesain dan mengoptimalkan cluster GKE Anda dengan Gemini

Dokumen ini menjelaskan cara merencanakan dan mendesain cluster dengan meminta Gemini.

Compute Advisor adalah antarmuka yang didukung AI di konsol Cloud de Confiance , yang didukung oleh Gemini, yang membantu Anda mengevaluasi opsi hardware, memperkirakan biaya deployment, dan melihat konfigurasi yang direkomendasikan untuk cluster Anda. Untuk menyesuaikan rekomendasinya, Gemini mengevaluasi project Anda dengan memeriksa batas kuota, reservasi yang ada, diskon abonemen (DA), region dan zona default, serta batasan lokasi resource. Cloud de Confiance by S3NS Dengan menggunakan Gemini untuk membantu perencanaan, Anda dapat mencapai konfigurasi optimal untuk beban kerja sebelum membuat atau mengubah cluster GKE.

Untuk mempelajari lebih lanjut komponen yang harus Anda konfigurasi sebelum atau saat membuat cluster GKE, lihat Ringkasan GKE.

Batasan

Saat memberikan perintah kepada Gemini di konsol Cloud de Confiance , Anda tidak dapat membuat, mengubah, atau menghapus resource menggunakan Gemini.

Sebelum memulai

Saat menggunakan konsol Cloud de Confiance untuk mengakses layanan Cloud de Confiance dan API, Anda tidak perlu menyiapkan autentikasi.

Peran yang diperlukan

Untuk mendapatkan izin yang diperlukan untuk mengakses dan meminta Gemini, minta administrator untuk memberi Anda peran IAM Kubernetes Engine Cluster Viewer (roles/container.clusterViewer) di project. Untuk mengetahui informasi selengkapnya tentang cara memberikan peran, lihat Mengelola akses ke project, folder, dan organisasi.

Peran bawaan ini berisi izin yang diperlukan untuk mengakses dan meminta Gemini. Untuk melihat izin yang benar-benar diperlukan, perluas bagian Izin yang diperlukan:

Izin yang diperlukan

Izin berikut diperlukan untuk mengakses dan meminta Gemini:

  • Untuk melihat daftar cluster: container.clusters.list

Anda mungkin juga bisa mendapatkan izin ini dengan peran khusus atau peran bawaan lainnya.

Mengakses Gemini di konsol Cloud de Confiance

Untuk mengakses Gemini di konsol Cloud de Confiance , selesaikan langkah-langkah berikut:

  1. Di konsol Cloud de Confiance , buka halaman Overview.

    Buka Ringkasan

  2. Di bagian Mendesain infrastruktur Anda dengan Compute Advisor, Anda dapat melihat hal berikut:

    Screenshot halaman Compute Advisor dan elemen UI yang menyusunnya.

    Elemen UI yang ditampilkan dalam screenshot sebelumnya adalah sebagai berikut:

    • Kartu perintah tindakan cepat: sekumpulan kartu yang masing-masing berisi contoh perintah. Jika Anda mengklik kartu, Cloud de Confiance console akan otomatis mengisi kotak perintah dengan perintah contoh.

    • Kotak perintah: kolom ini memungkinkan Anda memasukkan dan mengirimkan perintah. Untuk mengirimkan perintah, klik Kirim perintah.

    • Melihat percakapan sebelumnya: fitur ini memungkinkan Anda melihat detail percakapan sebelumnya dan melanjutkannya, atau menghapus percakapan jika Anda tidak lagi memerlukannya.

    • Panel samping histori percakapan: menampilkan percakapan terbaru Anda. Panel ini hanya terlihat setelah Anda mulai memberikan perintah dari halaman Ringkasan. Anda dapat berinteraksi dengan panel ini sebagai berikut:

      • Untuk memulai percakapan baru, klik Percakapan baru.

      • Untuk melanjutkan percakapan terbaru, di bagian Percakapan terbaru, klik percakapan.

      • Untuk melihat daftar semua percakapan Anda, klik Lihat semua. Di halaman Histori saya, Anda dapat melihat detail percakapan sebelumnya dan melanjutkannya, atau menghapus percakapan jika tidak lagi memerlukannya.

Memasukkan perintah ke Gemini

Setelah Anda mengirimkan perintah, Gemini akan mulai membuat respons. Panel akan muncul dan Cloud de Confiance konsol akan menampilkan respons terhadap perintah Anda di panel, seperti yang ditunjukkan pada screenshot berikut:

Screenshot halaman Compute Advisor setelah Anda mengirimkan perintah.

Berdasarkan perintah Anda, panel respons mencakup elemen berikut:

  • Perujukan kontekstual: Gemini secara otomatis mengevaluasi konteks project Anda untuk memberikan rekomendasi yang sangat disesuaikan, termasuk batas kuota, reservasi yang ada, CUD, region dan zona default Anda, serta batasan lokasi resource.

  • Cuplikan kode interaktif: Gemini membuat perintah gcloud, metode REST API, atau resource Terraform. Anda dapat menyalin dan menempelkan cuplikan kode ini atau menjalankannya di Cloud Shell.

  • Kanvas visual: Gemini mengatur rekomendasi ke dalam tabel terstruktur dan perbandingan berdampingan. Tampilan ini membantu Anda mengevaluasi fitur produk dan pendekatan arsitektur. Panduan ini juga memberikan rencana penerapan untuk kasus penggunaan Anda.

Bagian berikut menguraikan praktik terbaik untuk menulis perintah, dan contoh perintah yang dapat Anda gunakan sebelum membuat atau mengubah cluster GKE.

Praktik terbaik untuk perintah

Untuk mendapatkan rekomendasi yang paling akurat dan dapat ditindaklanjuti dari Gemini, sebaiknya susun perintah Anda dengan cara yang sama seperti yang Anda lakukan pada blok kode. Pendekatan ini memandu AI generatif dengan menggunakan deklarasi parameter yang jelas, definisi peran, petunjuk khusus, dan format output eksplisit.

Saat Anda memberikan perintah kepada Gemini, pertimbangkan praktik terbaik berikut:

  • Berfokus pada desain dan perencanaan: sebaiknya Anda tidak meminta Gemini untuk memecahkan masalah error cluster GKE. Untuk mengatasi error ini, lihat Memecahkan masalah GKE.

  • Tentukan persona atau peran: nyatakan target peran atau persona, seperti administrator IT, peneliti AI, atau engineer platform, yang akan diadopsi Gemini. Pendekatan ini memandu gaya bahasa, kedalaman, dan tingkat keahlian rekomendasi yang dihasilkan.

  • Berikan petunjuk bernomor yang jelas: pecah tujuan Anda menjadi pertanyaan atau tugas langkah demi langkah yang konkret. Pendekatan ini menyusun proses penalaran Gemini dan membantu memastikan bahwa Gemini memenuhi semua persyaratan Anda.

  • Tentukan format output tertentu: nyatakan secara eksplisit format rekomendasi yang Anda inginkan, seperti penjelasan langkah-langkah, tabel perbandingan Markdown, atau blok kode gcloud yang siap digunakan.

  • Memanfaatkan perujukan konteks otomatis: Anda tidak perlu menyertakan region atau zona default, kuota yang tersedia, CUD, atau batasan lokasi resource ke dalam perintah Anda. Gemini dapat mengakses informasi ini di project Cloud de Confiance Anda.

  • Menyempurnakan desain secara iteratif: Anda dapat mengubah atau memperluas respons yang dihasilkan Gemini dengan mengirimkan perintah baru. Misalnya, Anda dapat meminta asisten untuk menambahkan rekomendasi jaringan ke rencana deployment atau mengubah persyaratan penyimpanan tanpa memulai percakapan baru.

Contoh perintah

Berikut adalah contoh perintah yang dapat Anda gunakan untuk membantu Anda mendesain dan mengoptimalkan cluster GKE:

  • Topologi cluster dan konfigurasi node pool: untuk menentukan mode GKE, jenis mesin, dan konfigurasi node pool yang optimal untuk workload, gunakan perintah seperti berikut:

    Act as a cloud architect. I need to design a GKE cluster topology for a
    scalable microservices application that requires both GPU nodes for AI
    inference and CPU nodes for general-purpose APIs.
    
    Please provide the following:
    1. A comparison of running this workload on GKE Autopilot versus GKE Standard.
    2. Recommendations for GKE machine types for the GPU node pool.
    3. The optimal autoscaling and auto-provisioning settings.
    
    Format the comparison as a Markdown table, and provide the cluster creation
    steps as a ready-to-use gcloud CLI command.
    
  • Model penyediaan dan pengoptimalan biaya: untuk mengevaluasi model penyediaan dan mengoptimalkan pemanfaatan resource untuk beban kerja batch processing, gunakan perintah seperti berikut:

    Act as an IT administrator. I need to design a cost-optimized GKE cluster
    to run large-scale batch processing workloads that are fault-tolerant.
    
    Please provide the following:
    1. A cost and reliability comparison of using Spot VMs versus standard VMs
       in GKE node pools.
    2. An explanation of how to configure Kueue for queueing training jobs.
    3. A manifest snippet configuration to deploy the workloads onto Spot VM nodes.
    
    Format the comparison as a Markdown table, and provide the manifest as a
    ready-to-use code block.
    

Langkah berikutnya