Neste documento, descrevemos como usar o console do Cloud Monitoring para monitorar suas instâncias do Spanner.
O console do Cloud Monitoring oferece várias ferramentas de monitoramento para o Spanner:
- Um painel selecionado, que mostra gráficos predefinidos para seus recursos do Spanner
- Gráficos personalizados, incluindo gráficos ad hoc no Metrics Explorer e gráficos em painéis personalizados
- Alertas, que notificam você se uma métrica excede um limite especificado.
Se preferir monitorar o Spanner de forma programática, use as bibliotecas de cliente do Cloud para o Cloud Monitoring e recupere as métricas.
Usar o painel organizado do Cloud Monitoring
O Cloud Monitoring oferece um painel selecionado que resume as principais informações sobre suas instâncias do Spanner, incluindo:
- Incidentes: alertas de monitoramento criados pelo usuário que estão abertos, ativos ou resolvidos.
- Eventos: uma lista de registros de auditoria do Spanner (se ativados e disponíveis)
- Instâncias: um resumo de alto nível das suas instâncias do Spanner, incluindo capacidade de computação, contagem de bancos de dados e integridade da instância.
- Gráficos agregados de capacidade de processamento e uso de armazenamento
Para acessar o painel do Spanner, faça o seguinte:
No console do Google Cloud , selecione Monitoring ou use o botão a seguir:
Se Recursos for mostrado no painel de navegação, selecione Recursos e, em seguida, Cloud Spanner. Caso contrário, selecione Painéis e, em seguida, o painel chamado Cloud Spanner.
Conferir detalhes da instância e do banco de dados
Quando você abre o painel selecionado para o Spanner, ele mostra dados agregados de todas as suas instâncias. Para conferir mais detalhes sobre uma instância específica, clique no nome dela em Instâncias.
O painel exibe informações, como metadados da instância, bancos de dados incluídos nela e gráficos de várias métricas detalhadas por região.
Na página do painel da instância, também é possível ver os gráficos de um banco de dados específico na instância:
No lado direito, acima dos gráficos de métricas da instância, clique em Métricas do banco de dados.
Na lista suspensa Selecionar um detalhamento, selecione o banco de dados a ser examinado.
O console do Cloud Monitoring mostra gráficos para o banco de dados.
Criar gráficos personalizados para métricas do Spanner
Use o Cloud Monitoring para criar gráficos personalizados de métricas do Spanner. Use o Metrics Explorer para criar gráficos temporários e ad hoc ou gráficos que aparecem em painéis personalizados.
Em particular, o Cloud Monitoring permite criar um gráfico personalizado que mostra se duas ou mais métricas estão correlacionadas entre si. Por exemplo, é possível verificar uma correlação entre a utilização da CPU e a latência em uma instância do Spanner, o que pode indicar que a instância precisa de mais capacidade de computação ou que algumas das suas consultas estão causando alta utilização da CPU.
Para começar a usar esse exemplo, siga estas etapas:
No console do Google Cloud , selecione Monitoring ou use o botão a seguir:
Se o Metrics Explorer for mostrado no painel de navegação, selecione-o. Caso contrário, selecione Recursos e, em seguida, Metrics Explorer.
Clique na guia Opções de visualização e marque a caixa de seleção Escala do registro no eixo Y. Essa opção ajuda você a comparar várias métricas quando uma delas tem valores muito maiores do que as outras.
Na lista suspensa acima do painel direito, selecione Linha.
Clique na guia Métricas. Agora é possível adicionar métricas ao gráfico.
Para adicionar métricas de latência ao gráfico, siga estas etapas:
- Na caixa Localizar tipo de recurso e métrica, insira o valor
spanner.googleapis.com/api/request_latenciese clique na linha exibida abaixo da caixa. - Na caixa Filtro, insira o valor
instance_id, o ID da instância que você quer analisar e clique em Aplicar. - Na lista suspensa Agregador, clique em máx.
Se preferir, altere o percentil de latência:
- Clique em Mostrar opções avançadas.
- Clique na lista suspensa Alinhador e, em seguida, no percentil de latência que você quer visualizar.
Na maioria dos casos, analise a latência do 50º percentil para entender a quantidade típica de latência ou a latência do 99º percentil para entender a latência do 1% mais lento das solicitações.
Para adicionar métricas de utilização da CPU ao gráfico, siga estas etapas:
- Clique em Adicionar métrica.
- Na caixa Localizar tipo de recurso e métrica, insira o valor
spanner.googleapis.com/instance/cpu/utilizatione clique na linha exibida abaixo da caixa. - Na caixa Filtro, insira o valor
instance_id, o ID da instância que você quer analisar e clique em Aplicar. - Na lista suspensa Agregador, clique em máx.
Agora você tem um gráfico que mostra as métricas de uso da CPU e latência de uma instância do Spanner. Se as duas métricas estiverem mais altas do que o esperado ao mesmo tempo, tome outras medidas para corrigir o problema.
Para mais informações sobre como criar gráficos personalizados, consulte a documentação do Cloud Monitoring.
Criar alertas para métricas do Spanner
Ao criar uma instância do Spanner, você escolhe a capacidade de computação dela. Conforme a carga de trabalho da instância muda, o Spanner não ajusta automaticamente a capacidade de computação dela. Por isso, é necessário configurar vários alertas para garantir que a instância permaneça dentro dos valores máximos recomendados para utilização da CPU e do limite recomendado de armazenamento.
Os exemplos a seguir mostram como configurar políticas de alerta para algumas métricas do Spanner. Para conferir uma lista completa das métricas disponíveis, consulte lista de métricas do Spanner.
CPU de prioridade alta
Para criar uma política de alertas que é acionada quando o uso de CPU de alta prioridade para o Spanner está acima do limite recomendado, use as seguintes configurações.
| Novo estado Campo |
Valor |
|---|---|
| Recurso e métrica | No menu Recursos, selecione Instância do Spanner. No menu Categorias de métrica, selecione Instância. No menu Métricas, selecione Uso da CPU por prioridade. (O metric.type é spanner.googleapis.com/instance/cpu/utilization_by_priority).
|
| Filtrar | instance_id = YOUR_INSTANCE_IDpriority = high
|
| Séries cruzadas Série temporal agrupada por |
location para instâncias multirregionais. Deixe em branco para instâncias regionais. |
| Várias séries Agregação de série temporal |
sum |
| Janela contínua | 10 m |
| Função de janela contínua | mean |
| Campo Configurar gatilho de alerta |
Valor |
|---|---|
| Tipo de condição | Threshold |
| Acionador de alerta | Any time series violates |
| Posição do limite | Above threshold |
| Valor do limite | 45% para instâncias multirregionais. 65% para instâncias regionais. |
| Teste a janela novamente | 10 minutes |
CPU em média contínua de 24 horas
Para criar uma política de alertas que é acionada quando a média contínua de 24 horas de utilização da CPU para o Spanner está acima do limite recomendado, use as seguintes configurações.
| Novo estado Campo |
Valor |
|---|---|
| Recurso e métrica | No menu Recursos, selecione Instância do Spanner. No menu Categorias de métrica, selecione Instância. No menu Métricas, selecione Utilização suavizada da CPU. (O metric.type é spanner.googleapis.com/instance/cpu/smoothed_utilization).
|
| Filtrar | instance_id = YOUR_INSTANCE_ID |
| Várias séries Agregação de série temporal |
sum |
| Janela contínua | 10 m |
| Função de janela contínua | mean |
| Campo Configurar gatilho de alerta |
Valor |
|---|---|
| Tipo de condição | Threshold |
| Acionador de alerta | Any time series violates |
| Posição do limite | Above threshold |
| Limite | 90%
|
| Teste a janela novamente | 10 minutes |
Armazenamento
Para criar uma política de alertas que é acionada quando o armazenamento da sua instância do Spanner está acima do limite recomendado, use as seguintes configurações:
| Novo estado Campo |
Valor |
|---|---|
| Recurso e métrica | No menu Recursos, selecione Instância do Spanner. No menu Categorias de métrica, selecione Instância. No menu Métricas, selecione Armazenamento usado. (O metric.type é spanner.googleapis.com/instance/storage/utilization).
|
| Filtrar | instance_id = YOUR_INSTANCE_ID |
| Várias séries Agregação de série temporal |
sum |
| Janela contínua | 10 m |
| Função de janela contínua | max |
| Campo Configurar gatilho de alerta |
Valor |
|---|---|
| Tipo de condição | Threshold |
| Condition triggers if | Any time series violates |
| Posição do limite | Above threshold |
| Valor do limite | Não é necessário definir um limite específico para o armazenamento máximo por nó. No entanto, recomendamos que você configure um alerta para quando estiver se aproximando do limite máximo de armazenamento. Para saber mais, consulte Métricas de uso do armazenamento. |
| Teste a janela novamente | 10 minutes |
A seguir
- Entenda as métricas de uso da CPU e latência do Spanner.
- Use o console do Google Cloud para ter uma visão rápida das métricas mais importantes da sua instância.
- Saiba mais sobre o Cloud Monitoring.