Pengantar pemecahan masalah Cloud Run

Halaman ini menjelaskan strategi pemecahan masalah umum untuk error Cloud Run. Personalized Service Health memublikasikan semua insiden Cloud Run yang berasal dari infrastruktur Cloud de Confiance by S3NS yang mendasarinya untuk mengidentifikasi gangguan layanan Cloud de Confiance by S3NS yang memengaruhi project Anda. Anda juga harus mempertimbangkan menyiapkan pemberitahuan pada peristiwa Personalized Service Health. Untuk mengetahui informasi tentang insiden yang memengaruhi semua Cloud de Confiance by S3NS layanan, lihat dasbor Cloud de Confiance by S3NS Service Health.

Lihat bagian berikut dalam panduan pemecahan masalah Cloud Run untuk menyelesaikan masalah terkait resource Cloud Run Anda:

Strategi pemecahan masalah Cloud Run

Bagian berikut menjelaskan cara menerapkan strategi pemecahan masalah umum untuk mengatasi error. Jika Anda terus mengalami error bahkan setelah mengikuti langkah-langkah dalam panduan pemecahan masalah, lihat Langkah berikutnya.

Menghasilkan log yang baik menggunakan Cloud Logging

Pemecahan masalah resource Cloud Run Anda lebih mudah jika Anda memiliki log yang baik untuk proses debug. Anda harus menulis log sedemikian rupa sehingga menghubungkan log penampung Anda dengan log permintaan.

Dengan log yang dikorelasikan, Anda dapat mengidentifikasi permintaan yang memerlukan analisis lebih lanjut, menemukan rekaman aktivitas permintaan, dan menganalisis penyebab utama masalah. Untuk mengetahui informasi selengkapnya tentang cara menulis log, lihat Menulis log penampung.

Menyelidiki instance menggunakan Logs Explorer

Setiap log permintaan di Cloud Run berisi kolom instanceId yang mengidentifikasi instance yang menangani permintaan Anda. Bergantung pada nilai konkurensi yang Anda tentukan, satu instance dapat menangani beberapa permintaan secara bersamaan.

Jika Anda memiliki beberapa instance yang memancarkan log secara bersamaan, Anda harus memfilter instance untuk mengidentifikasi permintaan berurutan yang menyebabkan instance mengalami error.

Memfilter instance memungkinkan Anda men-debug masalah performa tertentu yang terkait dengan cold start atau peningkatan latensi. Masalah ini juga dapat terikat pada variabel yang dideklarasikan dalam cakupan global, saat nilai digunakan kembali dalam permintaan serentak berikutnya. Contohnya adalah saat Anda membuat objek global kumpulan koneksi tunggal untuk instance, lalu menggunakannya dalam beberapa permintaan.

Untuk memfilter instance tertentu di Logs Explorer, ikuti langkah-langkah berikut:

  1. Di konsol Cloud de Confiance , buka halaman Logs Explorer:

    Buka Logs Explorer

  2. Pilih project Cloud de Confiance by S3NS yang sudah ada di bagian atas halaman, atau buat project baru.

  3. Pilih resource Revisi Cloud Run untuk layanan, atau Tugas Cloud Run untuk tugas.

  4. Luaskan entri log untuk memfilter menurut instance tertentu.

  5. Klik nilai ID instance, lalu pilih Show matching entries.

Saat menyelidiki instance, Anda dapat menggunakan Investigasi Gemini Cloud Assist untuk mendapatkan insight tambahan tentang log Anda. Untuk mengetahui informasi selengkapnya tentang berbagai cara untuk memulai penyelidikan menggunakan Logs Explorer, lihat Memecahkan masalah dengan Penyelidikan Gemini Cloud Assist dalam dokumentasi Gemini.

Menyelesaikan latensi permintaan yang tidak terduga

Jika Anda mengalami masalah latensi, lakukan hal berikut:

  1. Periksa apakah latensi memengaruhi semua permintaan ke resource Cloud Run Anda atau hanya sebagian kecil. Cloud Run terintegrasi secara otomatis dengan Cloud Monitoring tanpa memerlukan penyiapan atau konfigurasi.

    Untuk melihat metrik latensi permintaan individual, ikuti langkah-langkah berikut:

    1. Di konsol Cloud de Confiance , buka halaman Cloud Run:

      Buka Cloud Run

    2. Pilih layanan atau tugas dari daftar yang tersedia di navigasi kiri.

    3. Klik tab METRIK untuk menampilkan dasbor Latensi permintaan.

    Untuk melihat metrik latensi di Cloud Monitoring, pilih dari daftar Metrics, Cloud Run Revision > Request_latencies > Request latency.

    Untuk mengetahui daftar semua metrik Cloud Run yang tersedia dan detail yang lebih mendalam, lihat metrikCloud de Confiance by S3NS di Cloud Monitoring.

  2. Identifikasi permintaan dengan latensi tinggi untuk memahami sumber latensi. Anda dapat menggunakan Cloud Trace atau Cloud Logging untuk memahami durasi permintaan tertentu.

    Untuk mengidentifikasi permintaan dengan latensi tinggi menggunakan Cloud Logging, terapkan filter traceSampled=true untuk menghubungkan log di Cloud Logging dengan rekaman aktivitas di Cloud Trace. Untuk mengetahui informasi selengkapnya, lihat Mengintegrasikan dengan Cloud Logging.

    Terkadang, dependensi seperti permintaan ke layanan lain dapat menyebabkan masalah latensi. Untuk mengidentifikasi permintaan tersebut, Anda harus memiliki penargetan pencatatan eksplisit untuk permintaan. Jika Anda tidak menghasilkan log tersebut, masalah ini dapat muncul sebagai masalah latensi yang berasal dari layanan Cloud Run.

    Selain itu, Anda harus mempertimbangkan untuk mengevaluasi lonjakan latensi dalam konteks jangka waktu yang dipilih. Signifikansi lonjakan bersifat relatif; lonjakan besar dalam jendela kecil mungkin tidak signifikan dalam jendela yang lebih besar, dan sebaliknya. Oleh karena itu, jangka waktu sangat memengaruhi interpretasi data latensi.

  3. Coba tingkatkan jumlah instance minimum untuk mengurangi latensi permintaan masuk, dan hindari cold start. Anda juga harus mempertimbangkan untuk mengubah kode sumber, dan menyesuaikan setelan penskalaan untuk membatasi jumlah koneksi ke layanan pendukung.

    Untuk mengetahui informasi selengkapnya, lihat Mengoptimalkan performa.

Memecahkan masalah konektivitas

Jika layanan Cloud Run Anda mengalami masalah konektivitas, pertimbangkan strategi dan alat berikut untuk mendiagnosis masalah:

  • Sidecar PCAP: Untuk analisis tingkat jaringan yang lebih mendalam, deploy sidecar PCAP bersama layanan Cloud Run Anda. Container sidecar ini melakukan pengambilan paket menggunakan tcpdump dalam namespace jaringan yang sama. Sidecar terlepas dari penampung ingress utama dan tidak memerlukan modifikasi apa pun untuk melakukan pengambilan paket. Sidecar juga menggunakan resource-nya sendiri, yang mencegah tcpdump bersaing dengan resource yang Anda alokasikan ke layanan utama.

  • Uji konektivitas dan analisis jaringan untuk revisi Cloud Run dan Cloud Run Functions: Lakukan pemeriksaan otomatis pada jalur jaringan antara resource Cloud Run dan endpoint Anda. Hal ini membantu Anda menemukan kesalahan konfigurasi yang dapat memblokir traffic ke atau dari resource Cloud Run saat terhubung ke instance VM, alamat IP, atau layanan yang dikelola Google.

  • Tinjau log untuk resource Cloud Run Anda: Log menampilkan pesan error tentang masalah koneksi, seperti kegagalan, waktu tunggu habis, atau koneksi ditolak. Log ini sering kali mengungkapkan apakah masalah koneksi terjadi pada aplikasi atau jaringan Anda.

Langkah berikutnya

Jika Anda tidak dapat menemukan solusi untuk masalah Anda dalam dokumentasi Cloud Run, ikuti langkah-langkah berikut: