Esta página descreve as estratégias comuns de solução de problemas para erros do Cloud Run. O Personalized Service Health publica todos os incidentes do Cloud Run decorrentes da infraestrutura Cloud de Confiance by S3NS para identificar Cloud de Confiance by S3NS interrupções de serviço que afetam seus projetos. Também é recomendável configurar alertas sobre eventos do Personalized Service Health. Para informações sobre incidentes que afetam todos os Cloud de Confiance by S3NS serviços, consulte o painel Cloud de Confiance by S3NS Service Health.
Consulte as seções a seguir no guia de solução de problemas do Cloud Run para resolver problemas relacionados ao seu recurso do Cloud Run:
Estratégias de solução de problemas do Cloud Run
As seções a seguir explicam como aplicar estratégias gerais de solução de problemas para resolver seu erro. Se os erros persistirem mesmo depois de seguir as etapas no guia de solução de problemas, consulte Próximas etapas.
Gerar bons registros usando o Cloud Logging
É mais fácil resolver problemas com o recurso do Cloud Run se você tiver bons registros para depuração. Escreva os registros de forma que correlacionem os registros de contêiner com um registro de solicitação.
Com os registros correlacionados, é possível identificar a solicitação que precisa de mais análise, encontrar o rastreamento da solicitação e analisar a causa raiz do problema. Para mais informações sobre como gravar registros, consulte Gravar registros de contêiner.
Investigar instâncias usando a Análise de registros
Cada registro de solicitação no Cloud Run contém um campo instanceId que identifica uma instância que processa sua
solicitação. Dependendo do valor de simultaneidade especificado, uma única instância pode processar várias solicitações ao mesmo tempo.
Quando você tem várias instâncias emitindo registros ao mesmo tempo, é necessário filtrar as instâncias para identificar as solicitações sequenciais que levam a uma falha.
Ao filtrar uma instância, é possível depurar problemas de desempenho específicos relacionados a inicializações a frio ou aumento da latência. Esses problemas também podem estar vinculados a variáveis declaradas em um escopo global, quando o valor é reutilizado em solicitações simultâneas subsequentes. Por exemplo, quando você cria um único objeto global de pool de conexões para a instância e o usa em várias solicitações.
Para filtrar uma instância específica na Análise de registros, siga estas etapas:
No console do Cloud de Confiance , acesse a página Análise de registros:
Selecione um projeto Cloud de Confiance by S3NS na parte de cima da página ou crie um novo.
Selecione o recurso Revisão do Cloud Run para um serviço ou Job do Cloud Run para um job.
Expanda uma entrada de registro para filtrar por uma instância específica.
Clique no valor do ID da instância e selecione Mostrar entradas correspondentes.
Ao investigar instâncias, você pode usar as investigações do Gemini Cloud Assist para ter mais insights sobre seus registros. Para mais informações sobre diferentes maneiras de iniciar uma investigação usando a Análise de registros, consulte Resolver problemas com o Gemini Cloud Assist Investigations na documentação do Gemini.
Resolver latências inesperadas de solicitações
Se você tiver problemas com latência, faça o seguinte:
Verifique se a latência está afetando todas as solicitações ao recurso do Cloud Run ou apenas uma pequena porcentagem. O Cloud Run é integrado automaticamente ao Cloud Monitoring sem necessidade de configuração.
Para conferir as métricas de latência de solicitações individuais, siga estas etapas:
No console Cloud de Confiance , acesse a página do Cloud Run:
Selecione um serviço ou um job nas listas disponíveis na navegação à esquerda.
Clique na guia MÉTRICAS para mostrar o painel Latências de solicitação.
Para ver métricas de latência no Cloud Monitoring, selecione na lista Métricas, Revisão do Cloud Run > Latências de solicitação > Latência de solicitação.
Para ver uma lista de todas as métricas do Cloud Run disponíveis e mais detalhes, consulte Cloud de Confiance by S3NS métricas no Cloud Monitoring.
Identifique a solicitação com alta latência para entender a origem dela. Use o Cloud Trace ou o Cloud Logging para entender quanto tempo uma solicitação específica levou.
Para identificar solicitações com alta latência usando o Cloud Logging, aplique o filtro
traceSampled=truepara correlacionar registros no Cloud Logging com rastreamentos no Cloud Trace. Para mais informações, consulte Integrar com o Cloud Logging.Às vezes, dependências, como solicitações a outros serviços, podem causar problemas de latência. Para identificar essas solicitações, você precisa ter um registro explícito direcionado a elas. Se você não gerar esses registros, isso poderá aparecer como um problema de latência originado de um serviço do Cloud Run.
Além disso, considere avaliar os picos de latência no contexto da janela de tempo escolhida. A importância de um pico é relativa. Um pico grande em uma janela pequena pode ser insignificante em uma janela maior, e vice-versa. Portanto, a janela de tempo afeta significativamente a interpretação dos dados de latência.
Tente aumentar o número de instâncias mínimas para reduzir a latência das solicitações recebidas e evitar inicializações a frio. Também é recomendável modificar o código-fonte e ajustar as configurações de escalonamento para limitar o número de conexões com um serviço de back-end.
Para mais informações, consulte Otimizar o desempenho.
Resolver problemas de conectividade
Se o serviço do Cloud Run estiver com problemas de conectividade, considere estas estratégias e ferramentas para diagnosticar o problema:
Arquivo secundário PCAP: para uma análise mais detalhada no nível da rede, implante um arquivo secundário PCAP ao lado do seu serviço do Cloud Run. Esse contêiner secundário realiza uma captura de pacote usando
tcpdumpno mesmo namespace de rede. O sidecar é desacoplado do contêiner de entrada principal e não requer modificações para realizar uma captura de pacote. Os sidecars também usam os próprios recursos, o que impede que otcpdumpconcorra com os recursos alocados ao serviço principal.Testes de conectividade e inteligência de rede para revisões do Cloud Run e funções do Cloud Run: realize verificações automatizadas no caminho de rede entre o recurso do Cloud Run e um endpoint. Isso ajuda a encontrar configurações incorretas que podem bloquear o tráfego de ou para seu recurso do Cloud Run ao se conectar a uma instância de VM, um endereço IP ou um serviço gerenciado pelo Google.
Analise os registros do seu recurso do Cloud Run: os registros mostram mensagens de erro sobre problemas de conexão, como falhas, tempos limite ou conexões recusadas. Esses registros geralmente revelam se o problema de conexão é com seu aplicativo ou com a rede.
A seguir
Se você não encontrar uma solução para seu problema na documentação do Cloud Run, siga estas etapas:
- Abra um caso de suporte entrando em contato com o Cloud Customer Care.
- Receba suporte da comunidade fazendo perguntas no StackOverflow ou pesquise problemas semelhantes usando a tag
google-cloud-run. - Abra bugs ou solicitações de recursos usando o Issue Tracker público.