Questa pagina descrive gli errori relativi allo spazio di archiviazione che potresti riscontrare quando utilizzi Backup per GKE, gli aspetti da considerare quando esegui l'azione e i passaggi per risolvere il problema.
Errore 100010105: Failed to backup PersistentVolumeClaim - Disk referenced by PersistentVolume does not exist
L'errore 100010105 si verifica quando un tentativo di eseguire il backup di un PersistentVolumeClaim
non riesce perché fa riferimento a un disco inesistente, generando un errore
che indica Failed to backup PersistentVolumeClaim - Disk referenced by PersistentVolume does not exist.
In Google Kubernetes Engine, PersistentVolumeClaims richiedono spazio di archiviazione da
PersistentVolumes. Un PersistentVolume, a sua volta, rappresenta una parte di spazio di archiviazione, spesso un disco permanente di Compute Engine sottostante. Può verificarsi un errore
quando un PersistentVolumeClaim è associato a un
PersistentVolume e la configurazione di PersistentVolume' specifica un
disco permanente di Compute Engine. Tuttavia, il disco effettivo con il nome e la
località specificati nella configurazione PersistentVolume non è stato trovato nel
tuo Cloud de Confiance by S3NS progetto. Di conseguenza, Backup per GKE non può procedere con il backup di un disco inesistente e si verifica un errore.
Per risolvere questo errore, segui queste istruzioni:
Identifica il
PersistentVolumeClaime ilPersistentVolumeproblematici. I nomi sia delPersistentVolumeClaimproblematico sia del relativoPersistentVolumesono elencati nel campostate reasondell'operazione di Backup per GKE non riuscita non riuscita. Ti consigliamo di documentare sia ilPersistentVolumeClaimnome, il relativo spazio dei nomi e il nome delPersistentVolume.Ispeziona il
PersistentVolume. Per descrivere ilPersistentVolume, utilizza il nome diPersistentVolumeche hai identificato dal campo del motivo dello stato nel seguente comando:kubectl describe pv PERSISTENTVOLUME_NAMESostituisci
PERSISTENTVOLUME_NAMEcon il nome del tuo PersistentVolume.Nell'output, esamina la sezione
source, in particolare sottocsi. Questa sezione descrive ilVolumeHandlea cuiPersistentVolumesta tentando di fare riferimento. Ad esempio:Source: Type: GCEPersistentDisk (a Persistent Disk resource in Google Compute Engine) PDName: my-non-existent-disk FSType: ext4 Partition: 0 ReadOnly: false In this example, the PD name is my-non-existent-disk. Source: Type: CSI (a Container Storage Interface (CSI) volume) Driver: pd.csi.storage.gke.io VolumeHandle: projects/PROJECT_ID/zones/ZONE/disks/DISK_NAME ...In questo esempio,
VolumeHandlecontiene il percorso completo del disco, inclusi il nome e la località. Ad esempio,projects/my-gcp-project/zones/us-central1-a/disks/my-disk-name.Utilizza
VolumeHandleottenuto dalla descrizione diPersistentVolumeper identificare il nome e la zona del disco.Verifica che il disco esista nel tuo Cloud de Confiance by S3NS progetto utilizzando uno dei seguenti metodi:
Disco a livello di zona
Se utilizzi un disco a livello di zona, utilizza Google Cloud CLI per eseguire il comando
gcloud compute disks describe:gcloud compute disks describe DISK_NAME \ --zone=ZONE_NAME \ --project=PROJECT_IDSostituisci quanto segue:
DISK_NAME: il nome del disco che hai ottenuto dalla descrizione diPersistentVolume.ZONE_NAME: la zona del disco che hai ottenuto dalla descrizione diPersistentVolume.PROJECT_ID: l'ID del tuo Cloud de Confiance by S3NS progetto.
Disco regionale
Se utilizzi un disco regionale, utilizza Google Cloud CLI per eseguire il comando
gcloud compute disks describe:gcloud compute disks describe DISK_NAME \ --region=REGION_NAME \ --project=PROJECT_IDSostituisci quanto segue:
DISK_NAME: il nome del disco che hai ottenuto dalla descrizione diPersistentVolume.REGION_NAME: la regione del disco che hai ottenuto dalla descrizione diPersistentVolume.PROJECT_ID: l'ID del tuo Cloud de Confiance by S3NS progetto.
Se ricevi un messaggio di errore
Resource not foundoThe resource DISK_NAME was not found, il disco non esiste. Utilizza uno dei seguenti metodi per risolvere il problema a seconda dello scenario più adatto alle tue esigenze:Se il disco è stato eliminato o rinominato per errore e vuoi conservare i dati o
PersistentVolumeClaim, oppure sePersistentVolumeè stato configurato con un nome disco errato, utilizza uno dei seguenti metodi per risolvere il problema:Ripristina il disco: se hai un backup del disco, ripristinalo con lo stesso nome e la stessa località a cui fa riferimento
PersistentVolume.Crea un nuovo disco: se il ripristino del disco non è un'opzione, crea un nuovo disco con lo stesso nome e la stessa località presenti nella
PersistentVolumeconfigurazione.
Se
PersistentVolumeClaimoPersistentVolume, i relativi dati o l' applicazione non sono più necessari, ti consigliamo di rimuovere l'entità non necessaria:- Elimina il
PersistentVolumeClaim: elimina ilPersistentVolumeClaimutilizzando lo strumento a riga di comandokubectlper eseguire il comandokubectl delete pvc:
kubectl delete pvc PVC_NAME -n NAMESPACESostituisci quanto segue:
PVC_NAME: il nome diPersistentVolumeClaimche vuoi eliminare.NAMESPACE: lo spazio dei nomi diPersistentVolumeClaimche vuoi eliminare.
- Elimina il
Il
PersistentVolumeè ancora presente dopo l'eliminazione diPersistentVolumeClaim: sePersistentVolumeReclaimPolicydiPersistentVolumeè impostato suDelete, ilPersistentVolumeviene eliminato automaticamente quando viene eliminatoPersistentVolumeClaim. SepersistentVolumeReclaimPolicyè impostato suRetain, devi eliminare manualmentePersistentVolumedopo l'eliminazione diPersistentVolumeClaim. Per eliminare ilPersistentVolume, utilizza lo strumento a riga di comandokubectlper eseguire il comandokubectl delete pv:kubectl delete pv PV_NAMESostituisci
PV_NAMEcon il nome diPersistentVolumeche vuoi eliminare.
Se l'operazione continua a non riuscire, contatta l'assistenza clienti Google Cloud per ulteriore assistenza.
Errore 100010202: Snapshotting volume failed
L'errore 100010202 si verifica quando la creazione dello snapshot del disco permanente di Compute Engine non riesce, generando un messaggio di errore che indica Snapshotting volume failed.
Un'operazione di snapshot del disco permanente di Compute Engine non riesce se lo stato di collegamento del disco a un'istanza di macchina virtuale (VM) cambia durante il processo di creazione dello snapshot avviato dal servizio Backup per GKE. Gli scenari comuni che attivano questo problema includono i seguenti:
- Riparazione automatica dei nodi: i nodi non integri vengono ricreati, causando la riprogrammazione dei pod e il distacco e il ricollegamento dei dischi.
- Upgrade dei nodi: durante gli upgrade dei pool di nodi, i nodi vengono in genere svuotati e sostituiti. I pod vengono terminati normalmente e riprogrammati sui nuovi nodi, attivando cicli di distacco e ricollegamento dei dischi.
- Scalabilità automatica del cluster: durante gli eventi di riduzione, se il gestore della scalabilità automatica del cluster rimuove un nodo, tutti i pod su quel nodo con dischi permanenti vengono eliminati, causando il distacco dei dischi. Se questi pod vengono riprogrammati altrove, i collegamenti si verificheranno sui nuovi nodi. Durante gli eventi di scalabilità orizzontale, i nuovi nodi non causano direttamente ricollegamenti, ma i pod pianificati su di essi attiveranno i collegamenti iniziali.
Si tratta di un errore temporaneo. In genere, il backup viene eseguito correttamente alla successiva esecuzione automatica una volta stabilizzato il collegamento del disco. Per evitare che gli eventi del cluster influiscano sui backup, applica i seguenti consigli:
Attiva la pianificazione intelligente: configura il piano di backup utilizzando la pianificazione intelligente (una pianificazione basata sull'RPO). In questo modo, il sistema può riprovare automaticamente a eseguire i backup non riusciti temporaneamente entro la finestra di tempo specificata senza influire sull'RPO complessivo del piano di backup.
Configura le finestre di esclusione dei backup: se esegui operazioni di upgrade pool di nodi o di ridimensionamento del cluster, aggiungi una finestra di esclusione dei backup alle impostazioni di backup durante questi intervalli. In questo modo, il servizio Backup per GKE metterà in pausa ed eviterà di pianificare gli snapshot mentre il cluster sta modificando attivamente i collegamenti dei dischi.
Riprova a eseguire i backup manuali: nel caso di backup manuali o on demand, riprova a eseguire l'operazione di backup al termine dell'evento del cluster.
Se l'operazione continua a non riuscire, contatta l'assistenza clienti Google Cloud per ulteriore assistenza.