Monitorar consultas contínuas
É possível monitorar consultas contínuas do BigQuery usando as seguintes ferramentas do BigQuery:
- Visualizações
INFORMATION_SCHEMA - Gráficos de execução de consulta
- Histórico de jobs
- Explorador de jobs
Devido à natureza de longa duração das consultas contínuas do BigQuery, métricas que geralmente são geradas após a conclusão de uma consulta SQL podem estar ausentes ou imprecisas.
Usar visualizações INFORMATION_SCHEMA
É possível usar várias visualizações INFORMATION_SCHEMA para monitorar consultas contínuas e reservas de consulta contínuas.
Ver detalhes do job
Você pode usar a
JOBS visualização para receber
metadados dos jobs de consulta contínuos.
A consulta a seguir retorna os metadados de todas as consultas contínuas ativas. Os metadados incluem o carimbo de data/hora da marca-d'água de saída, que representa o ponto até o qual a consulta contínua processou dados.
No Cloud de Confiance console, acesse a página BigQuery.
No Editor de consultas, execute esta consulta:
SELECT start_time, job_id, user_email, query, state, reservation_id, continuous_query_info.output_watermark FROM `PROJECT_ID.region-REGION.INFORMATION_SCHEMA.JOBS` WHERE creation_time > TIMESTAMP_SUB(CURRENT_TIMESTAMP(), INTERVAL 7 day) AND continuous IS TRUE AND state = "RUNNING" ORDER BY start_time DESC
Substitua:
PROJECT_ID: o ID do projeto.REGION: qualquer nome da região do conjunto de dados. Por exemplo,region-us.
Ver detalhes da atribuição de reserva
Você pode usar as
ASSIGNMENTS
e
RESERVATIONS visualizações para receber
detalhes da atribuição de reserva de consulta contínua.
Retorne detalhes de atribuição de reserva para consultas contínuas:
No Cloud de Confiance console, acesse a página BigQuery.
No Editor de consultas, execute esta consulta:
SELECT reservation.reservation_name, reservation.slot_capacity FROM `ADMIN_PROJECT_ID.region-LOCATION.INFORMATION_SCHEMA.ASSIGNMENTS` AS assignment INNER JOIN `ADMIN_PROJECT_ID.region-LOCATION.INFORMATION_SCHEMA.RESERVATIONS` AS reservation ON (assignment.reservation_name = reservation.reservation_name) WHERE assignment.assignee_id = 'PROJECT_ID' AND job_type = 'CONTINUOUS';
Substitua:
ADMIN_PROJECT_ID: o ID do projeto de administração que contém a reserva.LOCATION: o local da reserva.PROJECT_ID: o ID do projeto atribuído à reserva. Somente informações sobre consultas contínuas em execução neste projeto são retornadas.
Ver informações de consumo de slots
Você pode usar as
ASSIGNMENTS,
RESERVATIONS e
JOBS_TIMELINE visualizações para receber
informações de consumo do slot de consulta contínua.
Retorna informações de consumo de slots para consultas contínuas:
No Cloud de Confiance console, acesse a página BigQuery.
No Editor de consultas, execute esta consulta:
SELECT jobs.period_start, reservation.reservation_name, reservation.slot_capacity, SUM(jobs.period_slot_ms) / 1000 AS consumed_total_slots FROM `ADMIN_PROJECT_ID.region-LOCATION.INFORMATION_SCHEMA.ASSIGNMENTS` AS assignment INNER JOIN `ADMIN_PROJECT_ID.region-LOCATION.INFORMATION_SCHEMA.RESERVATIONS` AS reservation ON (assignment.reservation_name = reservation.reservation_name) INNER JOIN `PROJECT_ID.region-LOCATION.INFORMATION_SCHEMA.JOBS_TIMELINE` AS jobs ON ( UPPER(CONCAT('ADMIN_PROJECT_ID:LOCATION.', assignment.reservation_name)) = UPPER(jobs.reservation_id)) WHERE assignment.assignee_id = 'PROJECT_ID' AND assignment.job_type = 'CONTINUOUS' AND jobs.period_start BETWEEN TIMESTAMP_SUB(CURRENT_TIMESTAMP(), INTERVAL 1 DAY) AND CURRENT_TIMESTAMP() GROUP BY 1, 2, 3 ORDER BY jobs.period_start DESC;
Substitua:
ADMIN_PROJECT_ID: o ID do projeto de administração que contém a reserva.LOCATION: o local da reserva.PROJECT_ID: o ID do projeto atribuído à reserva. Somente informações sobre consultas contínuas em execução neste projeto são retornadas.
Também é possível monitorar reservas de consulta contínua usando outras ferramentas, como Metrics Explorer e gráficos de recursos administrativos. Para mais informações, consulte Monitore as reservas do BigQuery.
Usar o gráfico de execução de consulta
Você pode usar o gráfico de execução de consulta para receber insights de desempenho e estatísticas gerais para uma consulta contínua. Para mais informações, consulte Visualizar insights de desempenho da consulta.
Visualizar o histórico de tarefas
Você pode conferir os detalhes do job de consulta contínua no seu histórico profissional pessoal ou no histórico de job do projeto. Para mais informações, consulte Ver detalhes do job.
A lista histórica de jobs é classificada pela hora de início do job. Isso significa que as consultas contínuas que estão em execução há um tempo pode não estar perto do início da lista.
Usar o explorador de jobs
No explorador de jobs, filtre seus jobs para mostrar consultas contínuas definindo o filtro Categoria de job como Consulta contínua.
Usar o Cloud Monitoring
É possível conferir métricas específicas para consultas contínuas do BigQuery usando o Cloud Monitoring. Para mais informações, consulte Criar painéis, gráficos e alertas e leia sobre as métricas disponíveis para visualização.
Alertar sobre consultas com falha
Em vez de verificar rotineiramente se as consultas contínuas falharam, pode ser útil criar um alerta para notificar você sobre a falha. Uma maneira de fazer isso é criar uma métrica personalizada com base em registros do Cloud Logging com um filtro para seus jobs e uma política de alertas do Cloud Monitoring com base nessa métrica:
- Ao criar uma consulta contínua, use um
prefixo de ID de job personalizado.
Várias consultas contínuas podem compartilhar o mesmo prefixo.
Por exemplo, você pode usar o prefixo
prod-para indicar uma consulta de produção. No Cloud de Confiance console, acesse a página Métricas com base em registros.
Clique em Criar métrica. O painel Criar métrica de registros é exibido.
Em Tipo de métrica, selecione Contador.
Na seção Detalhes, atribua um nome à métrica. Por exemplo,
CUSTOM_JOB_ID_PREFIX-metric.Na seção Seleção de filtro, insira o seguinte no editor Criar filtro:
resource.type = "bigquery_project" protoPayload.resourceName : "projects/PROJECT_ID/jobs/CUSTOM_JOB_ID_PREFIX" severity = ERROR
Substitua:
PROJECT_ID: o nome do projeto.CUSTOM_JOB_ID_PREFIX: o nome do prefixo de ID de job personalizado definido para a consulta contínua.
Clique em Criar métrica.
No menu de navegação, clique em Métricas com base em registros. A métrica que você acabou de criar aparece na lista de métricas definidas pelo usuário.
Na linha da métrica, clique em Mais ações e em Criar alerta com base na métrica.
Clique em Próxima. Não é necessário mudar as configurações padrão na página Modo de configuração da política.
Clique em Próxima. Não é necessário mudar as configurações padrão na página Configurar acionador de alerta.
Selecione os canais de notificação e insira um nome para a política de alertas.
Clique em Criar política.
Para testar o alerta, execute uma consulta contínua com o prefixo de ID de job personalizado selecionado e cancele-o. Pode levar alguns minutos para que o alerta chegue ao seu canal de notificação.
Tentar novamente consultas com falha
Tentar novamente uma consulta contínua com falha pode ajudar a evitar situações em que um pipeline contínuo fica inativo por um período prolongado ou exige intervenção humana para ser reiniciado. As considerações importantes ao tentar novamente uma consulta contínua com falha incluem o seguinte:
- Se o reprocessamento de alguma quantidade de dados processados pela consulta anterior antes da falha é tolerável.
- Como limitar as tentativas ou usar a espera exponencial.
Uma possível abordagem para automatizar a repetição de consultas é a seguinte:
Crie um coletor do Cloud Logging com base em um filtro de inclusão que corresponda aos seguintes critérios para encaminhar registros a um tópico do Pub/Sub:
resource.type = "bigquery_project" protoPayload.resourceName : "projects/PROJECT_ID/jobs/CUSTOM_JOB_ID_PREFIX" severity = ERROR
Substitua:
PROJECT_ID: o nome do projeto.CUSTOM_JOB_ID_PREFIX: o nome do prefixo de ID de job personalizado definido para a consulta contínua.
Crie uma função do Cloud Run que seja acionada em resposta ao Pub/Sub que recebe registros que correspondem ao filtro.
A função do Cloud Run pode aceitar o payload de dados da mensagem do Pub/Sub e tentar iniciar uma nova consulta contínua usando a mesma sintaxe SQL da consulta com falha, mas no início, logo após a interrupção do job anterior.
Por exemplo, você pode usar uma função semelhante à seguinte:
Python
Antes de testar esta amostra, siga as instruções de configuração do Python no Guia de início rápido do BigQuery: como usar bibliotecas de cliente. Para mais informações, consulte a documentação de referência da API BigQuery em Python.
Para autenticar no BigQuery, configure o Application Default Credentials. Para mais informações, acesse Configurar a autenticação para bibliotecas de cliente.
Antes de executar exemplos de código, defina a variável de ambiente GOOGLE_CLOUD_UNIVERSE_DOMAIN como s3nsapis.fr.
A seguir
- Saiba como criar e executar consultas contínuas.