Wenn Probleme mit Ihren Google Kubernetes Engine-Clustern (GKE) oder -Anwendungen auftreten, ist es wichtig, schnell festzustellen, ob die Ursache intern ist oder mit einer umfassenderen Cloud de Confiance by S3NS Dienstunterbrechung zusammenhängt. Es ist ineffizient, Zeit mit dem lokalen Debugging zu verbringen, wenn die Ursache ein bekannter Plattformvorfall ist.
Auf dieser Seite können Sie feststellen, ob ein Problem mit Ihrem GKE-Cluster durch eine umfassendere Cloud de Confiance by S3NS Dienstunterbrechung verursacht wird. Hier erfahren Sie, wo Sie offizielle Statusaktualisierungen, personalisierte Statusereignisse und Informationen zu Dienstvorfällen aus den folgenden Quellen finden:
- Cloud de Confiance by S3NS Service Health: Statusinformationen für Cloud de Confiance by S3NS Dienste nach Region.
- Personalized Service Health: Dienstunterbrechungen, die für Ihre Projekte relevant sind.
- Informationen und Empfehlungen zu Dienstvorfällen: GKE Cluster, die von einem laufenden Dienstvorfall betroffen sind.
Diese Informationen sind wichtig für Plattformadministratoren und ‑Betreiber sowie Anwendungsentwickler, die Fehler beheben und wissen müssen, ob beobachtete Probleme mit einem umfassenderen Cloud de Confiance by S3NS Ereignis im Zusammenhang mit dem Dienststatus zusammenhängen. Weitere Informationen zu den gängigen Rollen und Beispielaufgaben, auf die wir in Cloud de Confiance by S3NS Inhalten verweisen, finden Sie unter Häufig verwendete GKE-Nutzerrollen und -Aufgaben.
Dienststatus prüfen Cloud de Confiance by S3NS
Auf der Cloud de Confiance by S3NS Service Health-Seite finden Sie Statusinformationen zu den Diensten bei Cloud de Confiance by S3NS.
Wenn Sie Vorfälle im Zusammenhang mit GKE prüfen möchten, rufen Sie die Cloud de Confiance by S3NS Service Health Seite auf.
Alle für Google Kubernetes Engine gemeldeten Vorfälle aufrufen
Personalized Service Health prüfen
Personalized Service Health ermöglicht es Ihnen, Cloud de Confiance by S3NS Dienstunterbrechungen zu erkennen, die für Ihre Projekte relevant sind. Diese Unterbrechungen werden als Dienststatusereignisse bezeichnet. Informationen dazu sind in der Cloud de Confiance Console und an einer Vielzahl von Integrations punkten verfügbar.
Wenn Sie Vorfälle im Zusammenhang mit GKE prüfen möchten, die für Ihre Projekte relevant sind, rufen Sie Dienststatusereignisse im Personalized Service Health Dashboard in der Cloud de Confiance Console auf.
Personalized Service Health aufrufen
Sie können Vorfälle nach Dienst, Standort, Relevanz und Status filtern. Das Dashboard enthält auch Vorfalldetails wie den Umfang der Auswirkungen, Symptome, Problemumgehungen und Updates zum Fortschritt der Lösung. Eine Einführung finden Sie unter Kurzanleitung: Dienststatusereignisse in der Cloud de Confiance Console ansehen.
Informationen und Empfehlungen zu Dienstvorfällen prüfen
Mit Informationen und Empfehlungen zu Dienstvorfällen können Sie GKE-Cluster identifizieren, die von einem laufenden Dienstvorfall betroffen sind.
Wenn Sie Informationen zu Dienstvorfällen erhalten möchten, rufen Sie Informationen und Empfehlungen für den Untertyp GKE_RELIABILITY_INCIDENT auf. Sie können Informationen über
die Cloud de Confiance Console, die Google Cloud CLI oder die Recommender API abrufen. Weitere
Informationen finden Sie unter Informationen und
Empfehlungen ansehen.
Informationen und Empfehlungen enthalten die folgenden Informationen:
- Betroffener Cluster: Ein Cluster, der von dem Vorfall betroffen ist.
- Name des Vorfalls: Eine Vorfall-ID zur Referenz, wenn Sie mit Cloud Customer Care kommunizieren.
- Beschreibung des Vorfalls: Informationen zum Vorfall vom Team für die Vorfallreaktion.
- Letzter effektiver Zeitpunkt: Der Zeitpunkt, zu dem die Informationen zum Vorfall zuletzt aktualisiert wurden.
- Abhilfemaßnahme: Abhilfemaßnahme, die vom Incident Response Team empfohlen wird, falls verfügbar.
Die Informationen zu Dienstvorfällen bleiben sichtbar, bis das Cloud de Confiance by S3NS Team für die Vorfall reaktion den Vorfall entschärft und feststellt, dass die Informationen nicht mehr relevant sind. Es gibt eine Verzögerung zwischen dem Zeitpunkt, zu dem der Vorfall entschärft wird und sich nicht mehr auf Ihre Ressourcen auswirkt, und dem Zeitpunkt, zu dem die Informationen entfernt werden. Wenn Sie eine Problemumgehung implementiert haben und die Informationen nicht mehr sehen möchten, können Sie sie verwerfen.
Nächste Schritte
Lesen Sie Cluster- und Arbeitslastzustand in der Cloud de Confiance Console bewerten (die nächste Seite in dieser Reihe).
Ratschläge zur Behebung bestimmter Probleme finden Sie in den Leitfäden zur Fehlerbehebung für GKE.
Wenn Sie in der Dokumentation keine Lösung für Ihr Problem finden, lesen Sie Support erhalten. Dort finden Sie auch Ratschläge zu den folgenden Themen:
- Supportanfrage erstellen, indem Sie sich an Cloud Customer Care wenden.
- Support von der Community erhalten, indem Sie
Fragen auf Stack Overflow stellen
und mit dem
google-kubernetes-engineTag nach ähnlichen Problemen suchen. Sie können auch dem#kubernetes-engineSlack-Kanal beitreten, um mehr Community-Support zu erhalten. - Probleme melden oder Featureanfragen stellen, indem Sie die öffentliche Problemverfolgung verwenden.