O processo mongot expõe métricas do Prometheus que descrevem sua integridade e desempenho em tempo de execução nas principais áreas de operação. Esta página de referência descreve as principais métricas relevantes para o monitoramento e a solução de problemas do dia a dia. Para o conjunto completo de métricas, raspe o ponto de extremidade de métricas mongot Prometheus em http://<mongot-host>:9946/metrics.
Ver métricas
Para visualizar as métricas brutas que o mongot expõe, envie uma solicitação HTTP GET para o seguinte ponto de extremidade de métricas do Prometheus mongot:
http://<mongot-host>:9946/metrics
Neste ponto de extremidade:
<mongot-host>é o nome do host ou endereço IP do processomongot.9946é a porta padrão para o ponto de extremidade de métricas. Para configurar a porta do ponto de extremidade de métricas, consulte a configuraçãometrics.addressno arquivo de configuraçãomongot./metricsé o caminho para o ponto de extremidade de métricas.
O ponto de extremidade /metrics retorna métricas no formato de texto simples do Prometheus. Para monitorar as métricas mongot ao longo do tempo, configure sua instância do Prometheus para extrair esse ponto de extremidade.
Importante
O ponto de extremidade /metrics não requer autenticação por padrão. Para implantações de produção, restrinja o acesso na camada de rede.
Convenções de nomenclatura de métricas
mongot os nomes das métricas usam um padrão de nomenclatura consistente:
Todos os nomes de métricas começam com o prefixo
mongot_.Os nomes das métricas geralmente seguem o padrão
mongot_<area>_<measurement>[_<unit>], onde:<area>indica o subsistema ou componente ao qual a métrica pertence, comoprocess,jvm,replicationouindex.<measurement>indica o que está sendo medido, comocpu_usage,heap_memoryouindex_size.<unit>(opcional) indica a semântica da unidade ou do contador para a métrica. Este sufixo opcional indica a unidade em que a métrica é medida, comoseconds,bytesoums, ou o tipo de contador que a métrica representa, comototal,eventsouoperations.Observação
Alguns sufixos de nome de métricas não refletem a unidade real relatada para a métrica. Por exemplo, o
mongot_index_stats_query_latency_secondstem o sufixo_seconds, mas omongotrelata a métrica em milissegundos, conforme indicado pelo rótulotimeUnit=millisecondsna saída da métrica. Para confirmar a unidade de cada métrica, verifique o valor Unit nas tabelas de referência de métricas abaixo.
Além do nome da métrica, as métricas mongot podem incluir rótulos (também chamados de dimensões). Os rótulos distinguem várias séries temporais que compartilham o mesmo nome de métrica base. Por exemplo, uma métrica pode usar rótulos para identificar um state, status, index type, quantile ou um index específico.
Para algumas métricas, você deve interpretar a métrica como a combinação do nome da métrica e seus rótulos, não apenas pelo nome da métrica. Por exemplo, mongot_replication_mongodb_indexManagerState usa o rótulo state para expor uma série para cada estado de replicação, como STEADY_STATE ou FAILED. Exatamente uma dessas séries rotuladas tem o valor 1 por vez. As métricas por índice usam rótulos como generationId_logString e indexId_logString para distinguir um índice do outro.
Para métricas de distribuição, o sufixo do nome da métrica indica o tipo de série Prometheus:
Os histogramas expõem
_bucket,_count,_sume_max.Os resumos expõem
_count,_sume_max. Alguns resumos também incluem rótulos de quantil, como{quantile="0.5"}.
Rótulos de métricas comuns
A tabela a seguir descreve os rótulos comuns que aparecem nas métricas mongot.
Nome do rótulo | Escopo da métrica | Valores possíveis |
|---|---|---|
| Todos os pools de executores |
|
| Transversal |
|
| A maioria das séries | IDs opacos internos (o identificador por índice que os logs usam) |
| Muitas métricas de índice |
|
| Métricas de indexação e sincronização inicial |
|
| Tamanho do índice e métricas do documento |
|
| Métricas de resumo de latência |
|
| Métricas de resumo |
|
|
|
|
|
|
|
|
|
|
Grupos de métricas principais
Métricas de processo e JVM
Use métricas de processo e JVM para confirmar se o mongot está sendo executado normalmente e para identificar a pressão de heap ou coleta de lixo.
Processo
Métrica | Tipo | unidade | Descrição |
|---|---|---|---|
| Medidor | Segundos | O tempo de atividade da Máquina Virtual Java. |
| Medidor | segundos unix | Hora de início do processo desde a Era UNIX. |
| Contador | nanossegundos | O "tempo de CPU" usado pelo processo da Java Virtual Machine. Use |
| Medidor | 0-1 | O "uso recente da CPU" para o processo da Máquina Virtual Java. O valor é normalizado para uma faixa de 0 a 1, onde 1 representa a utilização total da CPU. |
Memória JVM
Métrica | Tipo | unidade | Descrição |
|---|---|---|---|
| Medidor | bytes | A quantidade de memória usada. Rótulos: |
| Medidor | bytes | A quantidade de memória confirmada para a máquina virtual Java usar. |
| Medidor | bytes | A memória máxima que pode ser usada. Para heap, |
| Medidor | contar | Contagens do pool de buffer NIO. Rótulos: |
| Medidor | bytes | Memória que a JVM usa para pools de buffer NIO. |
| Medidor | bytes | Capacidade do pool de buffer NIO. |
JVM Coleção de lixo
Métrica | Tipo | unidade | Descrição |
|---|---|---|---|
| Resumo | Segundos | Tempo gasto na pausa do GC. Sem rótulos de quantil. Use |
| Resumo | Segundos | Tempo gasto na fase de GC simultâneo. |
| Medidor | bytes | Tamanho do pool de memória heap de longa duração após a recuperação. O "heap ativo" para observar a pressão da memória. |
| Medidor | bytes | Tamanho máximo do pool de memória heap de longa duração. |
| Contador | bytes | Aumento no tamanho do pool de heap jovem entre GCs. |
| Contador | bytes | Promoções da geração jovem para a geração antiga. |
Métricas do sistema
Use métricas do sistema para monitorar as condições de CPU, disco, memória, paginação e rede no nível do host que podem afetar mongot.
CPU
Métrica | Tipo | unidade | Descrição |
|---|---|---|---|
| Medidor | contar | Processadores disponíveis para a JVM. |
| Medidor | 0-1 | Uso recente da CPU do sistema. O valor é normalizado para uma faixa de 0 a 1, onde 1 representa a utilização total da CPU. |
| Medidor | sem unidade | Média de carga do SO 1minutos. |
Disk
Métrica | Tipo | unidade | Descrição |
|---|---|---|---|
| Medidor | bytes | Libere espaço em disco no volume |
| Medidor | bytes | Espaço total em disco no volume |
| Medidor | bytes | Espaço em disco livre e total em todo o sistema de arquivos (escopo diferente de |
| Medidor | bytes | Bytes lidos do disco por dispositivo. Rótulo: |
| Medidor | bytes | Bytes gravados por dispositivo. |
| Medidor | contar | Contagem de E/S de leitura por dispositivo. Use |
| Medidor | contar | Gravar contagem de E/S por dispositivo. |
| Medidor | contar | Comprimento da fila de disco (E/S em andamento) por dispositivo. |
| Medidor | Milissegundos | Tempo gasto lendo ou escrevendo por dispositivo. |
Memória
Métrica | Tipo | unidade | Descrição |
|---|---|---|---|
| Medidor | bytes | Memória física total no host. |
| Medidor | bytes | Memória física disponível. |
| Medidor | bytes | Memória física em uso. |
| Medidor | bytes | Memória física e virtual total em uso. |
| Medidor | bytes | Estado de troca. |
| Medidor | contar | Atividade de troca de entrada/saída. |
| Medidor | contar | Número de mapeamentos de memória (relevante para contagens de mmap do Lucene). |
| Medidor | bytes | Tamanho da página do sistema. |
Falhas na página
Métrica | Tipo | unidade | Descrição |
|---|---|---|---|
| Medidor | contar | Falhas de página principais. Use esta métrica com o limite consultivo da classe de armazenamento. |
| Medidor | contar | Falhas de página menores. |
Rede
Métrica | Tipo | unidade | Descrição |
|---|---|---|---|
| Medidor | bytes | Bytes recebidos e enviados por interface ( |
| Medidor | contar | Pacotes recebidos e enviados. |
| Medidor | contar | Contadores de erro, descarte e colisão. |
| Medidor | bits/seg | Velocidade da interface negociada. |
Métricas de replicação
Use métricas de replicação para determinar se mongot está saudável, sincronizando normalmente e acompanhando mongod.
Estado geral
Métrica | Tipo | unidade | Descrição |
|---|---|---|---|
| Medidor | 0/1 |
|
| Medidor | 0/1 |
|
| Contador | contar | Transições de estado. Rótulos: |
Atualizador de sessão
Métrica | Tipo | unidade | Descrição |
|---|---|---|---|
| Medidor | contar | Sessões ativas. |
| Contador | contar | Total de atualizações de sessão. |
| Contador | contar | Atualizações com falha. |
| Resumo | Segundos | Distribuição da duração da atualização. |
Atualizador de optime
Métrica | Tipo | unidade | Descrição |
|---|---|---|---|
| Contador | contar | Erros de atualizar de optime. |
| vários | N/A | Métricas do executor para o atualizador optime. |
Per-index Metrics
mongot emite as seguintes métricas por índice e inclui rótulos generationId_logString e indexId_logString para identificar o índice específico. Filtre por esses rótulos para inspecionar um índice específico ou agregue rótulos para entender o comportamento de toda a frota.
Status e tamanho do índice
Métrica | Tipo | unidade | Descrição |
|---|---|---|---|
| Medidor | 0/1 | Status por índice. Codificado em um único valor nos valores de rótulo |
| Medidor | número | Versão do formato de índice em disco. Por exemplo, |
| Medidor | bytes | Tamanho total do índice em disco. |
| Medidor | bytes | Maior arquivo único no índice. |
| Medidor | contar | Número de arquivos de segmento Lucene. |
| Medidor | contar | Documentos Lucene no índice. |
| Medidor | contar | ID máximo do documento Lucene (inclui excluído-não-mesclado). |
| Medidor | contar | Número de campos Lucene indexados. |
| Medidor | contar | Número de segmentos Lucene. |
| Medidor | bytes | Memória necessária estimada para o índice. |
Métricas de indexação
Métrica | Tipo | unidade | Descrição |
|---|---|---|---|
| Medidor | Milissegundos | Atraso de replicação por índice, em milissegundos. A unidade está no nome da métrica ( |
| Medidor | Carimbo de data/hora BSON | Última replicação aplicada optime (codificação numérica). |
| Medidor | Carimbo de data/hora BSON | Limite de adiantamento, definido pela dica |
| Contador | contar | Contagens de operações de indexação. Rótulo: |
| Contador | bytes | Total de bytes processados pela indexação. |
| Contador | contar | Campos de vetor indexados. |
| Resumo | segundos ( | Durações de confirmação por índice. |
| Resumo | Segundos | Distribuição da duração do lote. |
| Contador | contar | Eventos de fluxo de alterações superdimensionados. Rótulo: |
| Contador | contar | Documentos rejeitados por geometria inválida. |
| Contador | contar | Strings classificáveis truncadas. |
| Contador | contar | Exceções durante a sincronização inicial. |
| Contador | contar | Exceções de estado estacionário. |
| Medidor | contar | Exceções consecutivas de ressincronização de sincronização inicial para este índice. |
Métricas de query
Métrica | Tipo | unidade | Descrição |
|---|---|---|---|
| Contador | contar | Total de query emitidas contra o índice. |
| Contador | contar | Total de hits retornados. |
| Contador | contar | Consultas que falharam. |
| Contador | contar | Contadores de classe de falha específicos. |
| Resumo | segundos ( | Latência de lote de pesquisa. Esta é a métrica de latência de query principal. |
| Resumo | segundos ( | Latência dentro da pesquisa TopDocs do Lucene. Use essa métrica para distinguir a latência interna do Lucene da latência total. |
| Resumo | segundos ( | Latência do resultado da pesquisa vetorial. |
| Resumo | segundos ( | Fases de latência da pesquisa vetorial. |
| Resumo | segundos ( | Latência de atualização de estado de facetas. |
| Resumo | bytes / contagem | Tamanho do payload por lote e contagem de documentos. |
| histograma | contagem ( | Distribuição de |
| histograma | contar | Candidatos vetoriais por query, agrupados por quantização. |
| contador / resumo | contar |
|
| Contador | contar | Lotes de resultados com empates de pontuação. |
| Contador | contar | Query que se beneficiaram da otimização de ordenação indexada. |
| Contador | contar | Otimizações de extração de limite acionadas. |
| Contador | contar | Limpezas de pesquisadores fantasmas. |
| Resumo | proporção | Proporção de documentos excluídos nos resultados retornados. |
| Contador | contar | Lotes que não fizeram progresso. |
| Contador | contar | Contadores específicos de vetor. |
| Contador | contar | Uso de recursos por query. Rótulo: |
| Contador | contar | Agregados |
Detalhes da replicação por índice
Métrica | Tipo | unidade | Descrição |
|---|---|---|---|
| Medidor | 0/1 | O sinal canônico de estado de replicação. |
| Resumo | bytes / contagem | Tamanhos de lote de estado estacionário. |
| Resumo | Segundos | Duração de decodificação de estado estacionário. |
| Resumo | Segundos | Duração do |
| Resumo | — | Métricas da fase de fluxo de alterações de sincronização inicial (espelha o estado estável). |
| Resumo | — | Métricas da fase de varredura de coleção de sincronização inicial. |
Latência de atualização do Lucene
Métrica | Tipo | unidade | Descrição |
|---|---|---|---|
| Resumo | segundos ( | Latência de atualização do Lucene IndexReader. |
Métricas de comando
mongot aceita o seguinte conjunto de comandos nomeados de mongod:
buildinfogetMorehelloisMasterismasterkillCursorsmanageSearchIndexpingplanShardedSearchsearchvectorSearch
Para cada comando, o mongot expõe as seguintes métricas, onde <name> é um espaço reservado para o nome do comando:
Padrão | Tipo | Descrição |
|---|---|---|
| Contador | Contagem de falhas para o comando. |
| Resumo | Latência de ponta a ponta, incluindo serialização. |
| Resumo | Latência de serialização (subconjunto; nem todos os comandos). |
Dica
Monitorar a latência de pesquisa e a pesquisa vetorial entre índices
mongot_command_searchCommandTotalLatency_seconds e mongot_command_vectorSearchCommandTotalLatency_seconds são as métricas primárias a serem monitoradas para agregações de latência $search e $vectorSearch. Eles expõem agregações de latência para todos os comandos search e vectorSearch em todos os índices.
Métricas do agendador e do dispatcher de indexação
Use métricas de agendador e dispatcher de indexação para identificar atrasos, saturação e trabalho lento em pipelines de replicação e indexação.
Pipeline de fluxo de alterações em estado estacionário
Métrica | Tipo | unidade | Descrição |
|---|---|---|---|
| Medidor | contar | Lotes atualmente sendo aplicados. Rótulo: |
| Resumo | Segundos | Distribuição de duração para lotes em andamento. |
| Resumo | Segundos |
|
| Medidor | contar |
|
| Medidor | contar | Solicitações |
| Resumo | Segundos |
|
| Resumo | Segundos | Duração de pré-processamento por lote. |
| Contador | contar | Total de eventos de fluxo de alterações observados. Rótulo: |
| Contador | contar | Eventos que |
| Medidor | 0/1 | Status do dispatcher. Rótulos: |
| Contador | contar | Eventos ignorados devido a metadados ausentes. |
| Contador | contar | Falhas inesperadas no lote. |
| Contador | contar | getMores de embedding reprogramados. Essa métrica só está disponível quando você configura o Automated Embedding. |
| Contador | contar | Falha nas tentativas de amostragem do modo de fluxo de alterações. |
Agendador de trabalho de indexação
As métricas do agendador de trabalho de indexação monitoram o enfileiramento e a execução de lotes de indexação.
Métrica | Tipo | unidade | Descrição |
|---|---|---|---|
| Medidor | contar | Profundidade da fila do agendador. |
| Contador | contar | Contagens de enfileiramento e desenfileiramento. |
| Resumo | contar | Distribuição de tamanhos de lote. Rótulo: |
| Resumo | Segundos | Durações de lote. |
| Resumo | Segundos | Sobrecarga de agendamento. |
Decodificando o agendador de trabalho
As métricas do agendador de trabalho de decodificação monitoram o enfileiramento e a execução da decodificação em lote do fluxo de alterações.
Métrica | Tipo | unidade | Descrição |
|---|---|---|---|
| Medidor | contar | Profundidade da fila do agendador. |
| Contador | contar | Contagens de enfileiramento e desenfileiramento. |
| Resumo | contar | Distribuição de tamanhos de lote. Rótulo: |
| Resumo | Segundos | Durações de lote. |
| Resumo | Segundos | Sobrecarga de agendamento. |
Sincronização inicial, ciclo de vida e métricas de configuração
Use essas métricas para acompanhar o trabalho de inicialização do índice, a recuperação e o estado do catálogo.
Sincronização inicial
Observação
Algumas métricas mongot são específicas da fase e só são preenchidas quando o caminho de código correspondente está ativo. Por exemplo, métricas de replicação de estado estável, como mongot_index_stats_indexing_replicationLagMs e a série mongot_index_stats_replication_steadyState_*, não são preenchidas enquanto um índice está em sincronização inicial. Por outro lado, as métricas específicas da sincronização inicial, como mongot_initialsync_* e mongot_index_stats_replication_initialSync_*, só são relevantes enquanto a sincronização inicial está em execução ou foi executada.
Métrica | Tipo | unidade | Descrição |
|---|---|---|---|
| Medidor | contar | Sincronização inicial na fila. Rótulo: |
| Contador | contar | Embedding sincronizações iniciais que foram requeued. Essa métrica só está disponível quando você configura o Automated Embedding. |
| Medidor | contar | Sincronizações iniciais em andamento. Rótulo: |
| Medidor | contar | Sincronizações iniciais enfileiradas no dispatcher. |
| Medidor | contar | Sincronizações em andamento que foram retomadas a partir de um checkpoint. |
| Medidor | 0/1 | Modo de varredura de coleção ativo. Rótulo: |
| Resumo | Segundos | Distribuição de duração de sincronização concluída. |
| Resumo | Segundos | Duração da sincronização em andamento. |
| Medidor | Segundos | Mínimo, máximo e soma das durações de sincronização inicial em andamento. |
| Contador | contar | Descartados porque seus segmentos em disco não puderam ser lidos. |
| Contador | contar | Recuperado após segmentos ilegíveis. Rótulo: |
Ciclo de vida
Métrica | Tipo | unidade | Descrição |
|---|---|---|---|
| Medidor | contar | Índice atualmente no estado inicializado. |
| Resumo | Segundos | Durações de inicialização. |
| Contador | contar | Índice baixares que falharam. |
| Contador | contar | Descartar índices que falharam. |
| Contador | contar | Inicializações de índice que falharam. |
Estado da configuração
Métrica | Tipo | unidade | Descrição |
|---|---|---|---|
| Medidor | contar | Índices atualmente no catálogo. Rótulos: |
| Medidor | contar | Índices sendo eliminados gradualmente. |
| Medidor | contar | Índices preparados, mas ainda não ativos. |
| Medidor | contar | Equivalentes específicos da versão do recurso4. |
Cursores e fábrica de índices
Use essas métricas para monitorar o estado do cursor aberto e para detectar índices que mongot descartaram ou recuperaram porque seus segmentos em disco não puderam ser lidos.
Métrica | Tipo | unidade | Descrição |
|---|---|---|---|
| Medidor | contar | cursor abertos atualmente rastreados. |
| Contador | contar | Índices descartados porque seus segmentos não eram legíveis. |
| Contador | contar | Recuperações após segmentos ilegíveis. Rótulo: |
Mesclagem do Lucene
Use essas métricas para monitorar a atividade de mesclagem de segmentos do Lucene, incluindo o número e o tamanho das mesclagens em andamento, os tamanhos de entrada e saída de mesclagem, as durações de mesclagem e as mesclagens descartadas pela política de mesclagem de utilização de disco.
Métrica | Tipo | unidade | Descrição |
|---|---|---|---|
| Medidor | contar | Mesclagens ativas. Rótulo: |
| Medidor | contar | Documentos atualmente sendo mesclados. |
| Contador | contar | Total de mesclagens executadas desde a inicialização. |
| Contador | contar | Segmentos dobrados por mesclagens. |
| Resumo | bytes | Distribuição dos tamanhos de entrada de mesclagem. |
| Resumo | bytes | Distribuição dos tamanhos de saída de mesclagem. |
| Resumo | contar | Distribuição de documentos por mesclagem. |
| Resumo | Segundos | Distribuição da duração da mesclagem. |
| Contador | contar | Mesclagens descartadas pela política com reconhecimento de utilização de disco. |
Métricas do pool de conexões do cliente MongoDB
mongot abre vários pools de conexões nomeados para mongod e rotula cada pool com um rótulo clientName que identifica a função de cada pool. A tabela a seguir lista os possíveis valores de rótulo clientName e sua função correspondente:
clientName | Propósito |
|---|---|
| Replicação de fluxo de alterações de estado estacionário. |
| Sincronização inicial e atualização da sessão. O |
| Serviço de metadados interno. |
| Pesquisa de optime. |
| Pesquisas de metadados do banco de dados. |
| Pesquisas de informações do servidor. |
| Gerente de aluguel. |
| Gravações de embedding automatizadas. Esse pool de conexões só aparece quando você configura o embedding automatizado. |
A tabela a seguir lista as métricas disponíveis para pools de conexões mongot:
Métrica | Tipo | unidade | Descrição |
|---|---|---|---|
| Medidor | contar | Conexões abertas atualmente no pool. |
| Medidor | contar | Conexões atualmente verificadas. |
| Medidor | contar | maxPoolSize configurado. |
| Medidor | contar | Tamanho mínimo do pool configurado. |
| Contador | contar | Tentativas bem-sucedidas de link nativo do OpenSSL. |
| Contador | contar | Falha nas tentativas de link nativo do OpenSSL. |
Sinônimos
Use essas métricas para monitorar a atividade de sincronização de sinônimos, incluindo varreduras de coleção, durações de varredura e sincronização, profundidade da fila e exceções encontradas durante a sincronização de sinônimos.
Métrica | Tipo | unidade | Descrição |
|---|---|---|---|
| Contador | contar | Varreduras de coleção totais realizadas para sinônimos. |
| Contador | contar | Verificações de sinônimos acionadas por eventos de fluxo de alterações. |
| Resumo | Segundos | Distribuição da duração da verificação. |
| Resumo | Segundos | Distribuição da duração da sincronização. |
| Medidor | contar | Profundidade atual da fila de sincronização de sinônimos. |
| Contador | contar | Exceções de sincronização. |
Pools de executores
Use essas métricas para monitorar os pools de executores nomeados que o mongot usa para executar o trabalho em segundo plano. Cada pool expõe o mesmo conjunto de submétricas, prefixadas com o nome do pool, para que você possa acompanhar a atividade do thread, o dimensionamento do pool, a profundidade da fila, a taxa de transferência de tarefas e o tempo de execução por tarefa em todos os pools.
A tabela a seguir lista as submétricas que cada pool de executor expõe, onde <pool> é o prefixo do nome do pool. Todas as submétricas do pool de executor carregam o rótulo name="executorMetrics".
Sufixo de submétrica | Tipo | Descrição |
|---|---|---|
| Medidor | Threads executando tarefas no momento. |
| Medidor | Dimensionamento do pool. |
| Medidor | Tarefas aguardando um thread — o sinal de saturação. |
| Medidor | Capacidade restante da fila. |
| Contador | Tarefas concluídas desde a inicialização. |
| Resumo | Tempo de threads ociosas entre tarefas. |
| Resumo | Tempo de execução por tarefa. |
| Contador | Contagens de tarefas agendadas (para pools de agendamento). |
A tabela a seguir lista os prefixos para todos os pools de executores nomeados disponíveis e seus respectivos propósitos:
Prefixo do pool do executor | O que ele executa |
|---|---|
| Trabalho do ciclo de vida do armazenamento de blobs. |
| Bloqueando threads de trabalho do servidor gRPC. |
| Seleção do modo de stream de alterações. |
| Despacho de sincronização de fluxo de alteração (um dos mais movimentados em estado estacionário). |
| Sondagem de monitoramento de configuração. |
| Decodificação de workers de pipeline. |
| Sondagem do monitor de disco. |
| Temporizador de verificação de integridade gRPC. |
| Coleta de cursores ociosos. |
| Operações de confirmação de índice. |
| Trabalho de ciclo de vida por índice. |
| Atualizações do Lucene IndexReader. |
| Trabalhadores de pipeline de indexação (o pool de indexação mais movimentado em estado estável). |
| Trabalho de ciclo de vida de indexação. |
| Caminho de indexação de embedding automatizado. Esse pool de executores só aparece quando você configura o Automated Embedding. |
| Trabalho do ciclo de vida do tempo de inicialização. |
| Rastreamento e ciclo de vida de visualizações materializadas. Essas métricas só estão disponíveis quando o Automated Embedding ou outros recursos com suporte de visualizações materializadas estão configurados. |
| Atualizador de optime (segundo plano). |
| Atualizador de sessão. |
| Atualizador de métricas do sistema. |
Dica
Assista à saturação em todos os pools de executor
Para monitorar a saturação em todos os pools de executores, execute a seguinte query PromQL:
max by (pool) ( label_replace( {__name__=~"mongot_.+_executor_queued_tasks"}, "pool", "$1", "__name__", "mongot_(.+)_executor_queued_tasks" ) )
Esta query retorna a contagem de tarefas enfileiradas para cada pool de executor.
Prometheus Server Self-Metrics
A métrica a seguir está disponível para o servidor Prometheus incorporado em mongot:
Métrica | Tipo | unidade | Descrição |
|---|---|---|---|
| Resumo | segundos ( | Quanto tempo |
Métricas específicas da configuração
As seguintes famílias de métricas aparecem na saída /metrics somente quando você habilita recursos específicos.
Família de métricas | Descrição | Disponibilidade em autogerenciado mongot |
|---|---|---|
| Métricas relacionadas ao embedding automatizado. Por exemplo, | Aparecem somente quando você configura o Automated Embedding. |
| Contagem de falhas para o executor FTDC. | Aparece somente quando você habilita o sinalizador de recurso |
Exemplo de PromQL
A maioria das métricas de latência neste catálogo são resumos, não histogramas, portanto, use seus rótulos quantile publicados diretamente quando existirem. Um número menor de métricas, como mongot_index_stats_query_limitPerQuery e mongot_index_stats_query_numCandidatesPerQuery, são histogramas e expõem _bucket séries.
# Replication state max by (state) (mongot_replication_mongodb_indexManagerState) # Number of search indexes at STEADY_STATE replication mongot_replication_mongodb_indexManagerState{state="STEADY_STATE"} # Maximum replication lag across all indexes, converted to seconds max(mongot_index_stats_indexing_replicationLagMs) / 1000 # Index count by status count by (status) (mongot_index_stats_indexStatusCode == 1) # Search query p99 latency across all indexes max(mongot_index_stats_query_searchResultBatchLatencies_seconds{quantile="0.99"}) # Worst recent GC pause max(mongot_jvm_gc_pause_seconds_max) # Average GC pause over 5 minutes rate(mongot_jvm_gc_pause_seconds_sum[5m]) / rate(mongot_jvm_gc_pause_seconds_count[5m]) # Free disk percentage on dataPath mongot_system_disk_space_data_path_free_bytes / mongot_system_disk_space_data_path_total_bytes # Major page fault rate rate(mongot_system_process_majorPageFaults_operations[5m]) # Steady-state and initial sync exceptions over 15 minutes sum(rate(mongot_index_stats_indexing_steadyStateExceptions_total[15m])) sum(rate(mongot_index_stats_indexing_initialSyncExceptions_total[15m]))