mongot 프로세스는 작업의 주요 영역에 걸쳐 실행 시간 조건과 성능을 설명하는 Prometheus 지표를 노출합니다. 이 참조 페이지에서는 일상 모니터링 및 문제 해결에 관련된 주요 지표를 설명합니다. 완전한 지표 세트를 확인하려면 http://<mongot-host>:9946/metrics에 있는 mongot Prometheus 지표 엔드포인트를 스크래합니다.
메트릭 조회
mongot 이 노출하는 원시 지표를 보려면 다음 mongot Prometheus 지표 엔드포인트에 HTTP GET 요청을 보냅니다.
http://<mongot-host>:9946/metrics
이 엔드포인트에서:
<mongot-host>mongot프로세스의 호스트 이름 또는 IP 주소입니다.9946지표 엔드포인트의 기본 포트입니다. 지표 엔드포인트 포트를 구성하려면mongot설정 파일의metrics.address설정을 참조하세요./metrics지표 엔드포인트의 경로입니다.
/metrics 엔드포인트는 지표를 일반 Prometheus 텍스트 형식으로 반환합니다. 시간이 지남에 따라 mongot 지표를 모니터링하려면 Prometheus 인스턴스가 이 엔드포인트를 스크랩하도록 구성합니다.
중요
/metrics 엔드포인트는 기본값으로 인증이 필요하지 않습니다. 운영 배포서버의 경우, 네트워크 계층에서 접근을 제한하십시오.
지표 명명 관려
mongot 지표 이름에는 일관적인 명명 패턴이 사용됩니다.
모든 지표 이름은
mongot_접두사로 시작됩니다.지표 이름은 일반적으로
mongot_<area>_<measurement>[_<unit>]패턴을 따르며, 여기서:<area>process,jvm,replication또는index등 지표가 속한 하위 시스템 또는 컴포넌트를 나타냅니다.<measurement>cpu_usage,heap_memory,index_size등 측정 대상을 나타냅니다.<unit>(선택 사항) 지표에 대한 단위 또는 카운터 시맨틱스를 나타냅니다. 이 선택 사항 접미사는seconds,bytes또는ms등 지표가 측정되는 단위 또는total,events또는operations등 지표가 나타내는 카운터 유형을 나타냅니다.참고
일부 지표 이름 접미사는 지표에 대해 실제로 보고된 단위를 반영하지 않습니다. 예시를 들어
mongot_index_stats_query_latency_seconds은 접미사_seconds을 가지고 있지만,mongot는 지표 출력의timeUnit=milliseconds레이블에서 알려준 것처럼 밀리초 단위로 지표를 보고합니다. 각 지표의 단위를 확인하려면 아래의 지표 참조 표에서 Unit 값을 확인하십시오.
지표 이름 외에도 mongot 지표에는 레이블(디멘전이라고도 함) 이 포함될 수 있습니다. 레이블은 동일한 기본 지표 이름을 공유하는 여러 시계열을 구별합니다. 예를 들어, 지표는 레이블을 사용하여 state, status, index type, quantile 또는 특정 index를 식별할 수 있습니다.
일부 지표의 경우 지표를 지표 이름과 레이블의 조합으로 해석해야 하며 지표 이름만으로 해석해서는 안 됩니다. 예시들어 mongot_replication_mongodb_indexManagerState 은 state 레이블을 사용하여 STEADY_STATE 또는 FAILED와 같은 복제 상태별로 하나의 시리즈를 노출합니다. 정확히 하나의 레이블된 시리즈는 한 번에 1 값을 가집니다. 인덱스별 지표는 비슷하게 generationId_logString 및 indexId_logString 와 같은 레이블을 사용하여 인덱스를 구별합니다.
분포 지표의 경우 지표 이름의 접미사는 Prometheus 시리즈 유형을 나타냅니다.
히스토그램은
_bucket,_count,_sum,_max을 노출합니다.요약에서는
_count,_sum,_max를 노출합니다. 일부 요약에는{quantile="0.5"}와 같은 양형 레이블도 포함됩니다.
일반적인 지표 레이블
다음 표에는 mongot 지표에 나타나는 일반적인 레이블이 설명되어 있습니다.
레이블 이름 | 지표 범위 | Possible Values |
|---|---|---|
| 모든 실행자 푸일 |
|
| 크로스 커팅 |
|
| 대부분의 | 내부 불투명 ID(로그에서 사용하는 인덱스별 식별자) |
| 많은 인덱스 지표 |
|
| 인덱싱 및 초기 동기화 지표 |
|
| 인덱스 크기 및 문서 지표 |
|
| 지연 시간 요약 지표 |
|
| 요약 지표 |
|
|
|
|
|
|
|
|
|
|
주요 지표 그룹
프로세스 및 JVM 지표
프로세스 및 JVM 지표를 사용하여 mongot 가 정상적으로 실행 중인지 확인하고 힙 또는 가버지 컬렉션 부하를 식별합니다.
프로세스
메트릭 | 유형 | 단위 | 설명 |
|---|---|---|---|
| 게이지 | 초 | Java 가상 머신의 가동 시간. |
| 게이지 | unix 초 | 유닉스 시간을 기준으로 프로세스의 시작 시간입니다. |
| 카운터 | 나노초 | Java 가상 머신 프로세스에서 사용하는 "지연 시간". 실시간 CPU 소비량에 |
| 게이지 | 0-1 | Java 가상 마신 프로세스의 "최근 CPU 사용량" 입니다. 값은 0 에서 1까지의 범위로 정규화되며, 1 는 완전한 CPU 사용막을 나타냅니다. |
JVM 메모리
메트릭 | 유형 | 단위 | 설명 |
|---|---|---|---|
| 게이지 | 바이트 | 사용된 메모리 양. 레이블: |
| 게이지 | 바이트 | Java 가상 마신이 사용할 수 있도록 커밋된 메모리 양입니다. |
| 게이지 | 바이트 | 사용할 수 있는 최대 메모리입니다. 힙의 경우 |
| 게이지 | 카운트 | NIO 버퍼 풀 카운트입니다. 레이블: |
| 게이지 | 바이트 | NIO 버퍼 푸릴에 사용되는 JVM 메모리. |
| 게이지 | 바이트 | NIO 버퍼 풀 용량. |
JVM 가비지 컬렉션
메트릭 | 유형 | 단위 | 설명 |
|---|---|---|---|
| 요약 | 초 | GC 일시 중지에 소요된 시간입니다. 에서 엔드포인트에서 쿼탄타일 레이블을 사용하지 않습니다. 가장 긴 최근 일시 중지에 |
| 요약 | 초 | 동시 GC 단계에서의 소요 시간. |
| 게이지 | 바이트 | 회수 후 장기 지속 힙 메모리 푸일의 크기. 메모리 압력을 주의해야 할 “라이브 힙”. |
| 게이지 | 바이트 | 장기 유지 heap 메모리 풀의 최대 크기입니다. |
| 카운터 | 바이트 | GC 사이의 young heap pool 크기 증가입니다. |
| 카운터 | 바이트 | 젊은 세대에서 오래된 세대로의 승진. |
시스템 지표
시스템 지표를 사용하여 mongot에 영향을 밀칠 수 있는 호스트 수준 CPU, 디스크, 메모리, 페이징 및 네트워크 상태를 모니터링합니다.
중앙처리장치
메트릭 | 유형 | 단위 | 설명 |
|---|---|---|---|
| 게이지 | 카운트 | JVM에서 사용 가능한 프로세서. |
| 게이지 | 0-1 | 최근 시스템 CPU 사용량입니다. 값은 0 에서 1까지의 범위로 정규화되며, 1 는 완전한 CPU 사용막을 나타냅니다. |
| 게이지 | unitless | OS 1분 로드 평균. |
Disk
메트릭 | 유형 | 단위 | 설명 |
|---|---|---|---|
| 게이지 | 바이트 |
|
| 게이지 | 바이트 |
|
| 게이지 | 바이트 | 파일 시스템의 자유 및 총 디스크 공간( |
| 게이지 | 바이트 | 장치별 디스크에서 읽은 바이트. 레이블: |
| 게이지 | 바이트 | 장치당 기록된 바이트 수. |
| 게이지 | 카운트 | 장치별 읽기 I/O 카운트입니다. 읽기 IOPS에 |
| 게이지 | 카운트 | 장치 별 쓰기 (write) I/O 카운트. |
| 게이지 | 카운트 | 장치당 디스크 큐 길이(진행 중인 I/O). |
| 게이지 | 밀리초 | 기기별 읽기 또는 쓰기에 소비된 시간. |
메모리
메트릭 | 유형 | 단위 | 설명 |
|---|---|---|---|
| 게이지 | 바이트 | 호스트에서의 총 물리 메모리. |
| 게이지 | 바이트 | 사용 가능한 물리 메모리. |
| 게이지 | 바이트 | 사용 중인 물리 메모리. |
| 게이지 | 바이트 | 사용 중인 총 물리 메모리 및 가상 메모리입니다. |
| 게이지 | 바이트 | 상태 스와합. |
| 게이지 | 카운트 | 스와프 입/출력 활동. |
| 게이지 | 카운트 | 메모리 매핑 수(Lucene mmap 카운트와 관련됨). |
| 게이지 | 바이트 | 시스템 페이지 크기입니다. |
페이지 오류
메트릭 | 유형 | 단위 | 설명 |
|---|---|---|---|
| 게이지 | 카운트 | 주 페이지 오류. 이 지표를 저장 클래스 권고 임계값과 함께 사용합니다. |
| 게이지 | 카운트 | 소곜 페이지 오류. |
네트워크
메트릭 | 유형 | 단위 | 설명 |
|---|---|---|---|
| 게이지 | 바이트 | 인터페이스별 수신 및 전송 바이트( |
| 게이지 | 카운트 | 패킷 수신 및 전송. |
| 게이지 | 카운트 | 오류, 제거 및 충돌 카운터. |
| 게이지 | bits/sec | 협상된 인터페이스 속도. |
복제 메트릭
복제 지표를 사용하여 mongot 이 정상 상태인지, 정상적으로 동기화되는지, mongod과 동기화 상태를 유지하는지 확인합니다.
전체 상태
메트릭 | 유형 | 단위 | 설명 |
|---|---|---|---|
| 게이지 | 0/1 |
|
| 게이지 | 0/1 |
|
| 카운터 | 카운트 | 상태 전이. 레이블: |
세션 새로 고침
메트릭 | 유형 | 단위 | 설명 |
|---|---|---|---|
| 게이지 | 카운트 | 활성 세션. |
| 카운터 | 카운트 | 총 세션 새로 고침. |
| 카운터 | 카운트 | 새로 고침 실패. |
| 요약 | 초 | 새로 고침 기간 분포. |
optime 업데이터
메트릭 | 유형 | 단위 | 설명 |
|---|---|---|---|
| 카운터 | 카운트 | Optime-업데이트 오류. |
| 다양한 | N/A | optime 업데이터의 실행기 지표. |
Per-index Metrics
mongot 인덱스별로 다음 지표를 발급하고 generationId_logString 및 indexId_logString 레이블을 포함하여 특정 인덱스를 식별합니다. 이러한 레이블로 필터링하여 특정 인덱스를 검사하거나 레이블별로 집계하여 플리트 전체의 동작을 파악합니다.
인덱스 상태 및 크기
메트릭 | 유형 | 단위 | 설명 |
|---|---|---|---|
| 게이지 | 0/1 | 인덱스별 상태. |
| 게이지 | 숫자 | 온디스크 인덱스 형식 버전입니다. 예시: |
| 게이지 | 바이트 | 인덱스의 총 온디스크 크기. |
| 게이지 | 바이트 | 인덱스에서 가장 큰 단일 파일입니다. |
| 게이지 | 카운트 | Lucene 세그먼트 파일의 수. |
| 게이지 | 카운트 | 인덱스의 Lucene 문서. |
| 게이지 | 카운트 | 최대 Lucene 문서 ID(삭제되었지만 병합되지 않은 문서 포함). |
| 게이지 | 카운트 | 인덱스된 Lucene 필드 수. |
| 게이지 | 카운트 | Lucene 세그먼트 수. |
| 게이지 | 바이트 | 인덱스에 필요한 최대 메모리 추정치입니다. |
인덱싱 지표
메트릭 | 유형 | 단위 | 설명 |
|---|---|---|---|
| 게이지 | 밀리초 | 인덱스별 복제 지연(밀리초). 단위는 지표 이름( |
| 게이지 | BSON 타임스탬프 | 마지막으로 적용된 복제 optime(숫자 인코딩). |
| 게이지 | BSON 타임스탬프 |
|
| 카운터 | 카운트 | 인덱싱 작업 횟수. 레이블: |
| 카운터 | 바이트 | 인덱싱으로 처리된 총 바이트 수. |
| 카운터 | 카운트 | 인덱싱된 벡터 필드입니다. |
| 요약 | 초( | 인덱스별 커밋 기간. |
| 요약 | 초 | 배치 기간 분포. |
| 카운터 | 카운트 | 과대한 변경 스트림 이벤트. 레이블: |
| 카운터 | 카운트 | 유효하지 않은 기하학으로 인해 거부된 문서. |
| 카운터 | 카운트 | 잘린 정렬 가능한 문자열. |
| 카운터 | 카운트 | 초기 동기화 중 예외. |
| 카운터 | 카운트 | 정상 상태 예외. |
| 게이지 | 카운트 | 이 인덱스에 대한 초기 동기화 재동기화 예외가 연속되어 발생합니다. |
쿼리 지표
메트릭 | 유형 | 단위 | 설명 |
|---|---|---|---|
| 카운터 | 카운트 | 인덱스에 대해 발행된 총 쿼리. |
| 카운터 | 카운트 | 반환된 총 히트 수입니다. |
| 카운터 | 카운트 | 실패한 쿼리. |
| 카운터 | 카운트 | 특정 실패 클래스 카운터. |
| 요약 | 초( | 배치 지연 시간을 검색합니다. 이는 헤드라인 쿼리 지연 시간 지표입니다. |
| 요약 | 초( | Lucene의 TopDocs 검색 내의 지연 시간. 이 지표를 사용하여 Lucene 내부 지연 시간과 총 지연 시간을 구분합니다. |
| 요약 | 초( | 벡터 검색 결과 지연 시간. |
| 요약 | 초( | 벡터 검색 지연 시간 단계. |
| 요약 | 초( | 패싯 상태 새로 고침 지연 시간. |
| 요약 | 바이트 / 카운트 | 배치당 페이로드 크기 및 문서 수. |
| 히스토그램 | 개수 ( |
|
| 히스토그램 | 카운트 | 양자화되어 버킷된 쿼리당 벡터 후보. |
| 카운터 / 요약 | 카운트 |
|
| 카운터 | 카운트 | 점수 동점이 있는 결과 배치. |
| 카운터 | 카운트 | 인덱스 정렬 최적화의 이점을 받은 쿼리입니다. |
| 카운터 | 카운트 | 제한 추출 최적화가 트리거되었습니다. |
| 카운터 | 카운트 | 팬텀 서치어 정리. |
| 요약 | 비율 | 반환된 결과에서 삭제된 문서 비율. |
| 카운터 | 카운트 | 앞으로 진행되지 않은 배치. |
| 카운터 | 카운트 | 벡터 전용 카운터. |
| 카운터 | 카운트 | 쿼리 기능별 사용. 레이블: |
| 카운터 | 카운트 |
|
인덱스 별 복제 분해
메트릭 | 유형 | 단위 | 설명 |
|---|---|---|---|
| 게이지 | 0/1 | 캐노니컬 복제 상태 신호입니다. |
| 요약 | 바이트 / 카운트 | 정상 상태 배치 크기. |
| 요약 | 초 | 상태 유지 디코딩 기간. |
| 요약 | 초 | 정상 상태 |
| 요약 | — | 초기 동기화 변경 스트림 단계 지표(안정적 상태를 반영). |
| 요약 | — | 초기 동기화 컬렉션 스캔 단계 지표입니다. |
Lucene 새로 고침 지연 시간
메트릭 | 유형 | 단위 | 설명 |
|---|---|---|---|
| 요약 | 초( | Lucene IndexReader 새로 고침 지연 시간. |
명령 지표
mongot mongod에서 다음 명명의 집합을 허용합니다.
buildinfogetMorehelloisMasterismasterkillCursorsmanageSearchIndexpingplanShardedSearchsearchvectorSearch
각 명령에 대해 mongot 은 다음과 같은 지표를 노출합니다. 여기서 <name> 은 명령 이름의 자리 표시자입니다.
패턴 | 유형 | 설명 |
|---|---|---|
| 카운터 | 명령의 실패 횟수. |
| 요약 | 직렬화를 포함한 전체 지연 시간. |
| 요약 | 직렬화 지연 시간(서브세트, 모든 명령이 아닙니다). |
팁
인덱스 전체의 검색 및 벡터 검색 지연 시간 모니터링
mongot_command_searchCommandTotalLatency_seconds 및 mongot_command_vectorSearchCommandTotalLatency_seconds 은 $search 및 $vectorSearch 지연 시간 집계를 모니터링하기 위한 주 지표입니다. 이들은 모든 인덱스에 걸쳐 모든 search 과 vectorSearch 명령에 대한 지연 시간 집계를 노출합니다.
인덱싱 스케줄러 및 디스패쳐 지표
인덱싱 스케줄러 및 디스패치 지표를 사용하여 복제 및 인덱싱 파이프라인의 백로그, 포화 및 저속 작업을 식별합니다.
정상 상태 변경 스트림 파이프라인
메트릭 | 유형 | 단위 | 설명 |
|---|---|---|---|
| 게이지 | 카운트 | 현재 적용 중인 배치. 레이블: |
| 요약 | 초 | 인플라이트 배치의 기간 분포. |
| 요약 | 초 |
|
| 게이지 | 카운트 |
|
| 게이지 | 카운트 |
|
| 요약 | 초 |
|
| 요약 | 초 | 배치당 전처리 기간. |
| 카운터 | 카운트 | 관찰된 총 변경 스트림 이벤트 수. 레이블: |
| 카운터 | 카운트 |
|
| 게이지 | 0/1 | 디스패쳐 상태입니다. 레이블: |
| 카운터 | 카운트 | 메타데이터가 없어 건너런 이벤트. |
| 카운터 | 카운트 | 예치 않은 배치 실패. |
| 카운터 | 카운트 | 임베딩 getMores 다시 스케줄될. 이 지표는 자동 임베딩을 구성할 때만 사용할 수 있습니다. |
| 카운터 | 카운트 | 변경 스트림 모드 샘플링 시도 실패. |
인덱싱 작업 스케줄러
인덱싱 작업 스케줄러 지표는 인덱싱 배치의 대기 열과 실행을 모니터링합니다.
메트릭 | 유형 | 단위 | 설명 |
|---|---|---|---|
| 게이지 | 카운트 | Scheduler 큐 깊이. |
| 카운터 | 카운트 | 대기 열에 추가되고 제거되는 카운트입니다. |
| 요약 | 카운트 | 배치 크기 분포. 레이블: |
| 요약 | 초 | 배치 기간. |
| 요약 | 초 | 오버헤드 예정. |
디코딩 작업 스케줄러
디코딩 작업 스케줄러 지표는 변경 스트림 배치 디코딩의 큐잉 및 실행을 모니터링합니다.
메트릭 | 유형 | 단위 | 설명 |
|---|---|---|---|
| 게이지 | 카운트 | Scheduler 큐 깊이. |
| 카운터 | 카운트 | 대기 열에 추가되고 제거되는 카운트입니다. |
| 요약 | 카운트 | 배치 크기 분포. 레이블: |
| 요약 | 초 | 배치 기간. |
| 요약 | 초 | 오버헤드 예정. |
초기 동기화, 라이프사이클 및 구성 지표
이 지표를 사용하여 인덱스 스타트업 작업, 복구 및 카탈로그 상태를 추적합니다.
초기 동기화
참고
일부 mongot 지표는 단계 특정적이며, 해당 코드 경로가 활성화되어 있는 경우에만 포함됩니다. 예를 들어, mongot_index_stats_indexing_replicationLagMs 및 mongot_index_stats_replication_steadyState_* 시리즈와 같은 정상 상태 복제 지표는 인덱스가 초기 동기화 중인 동안에는 포함되지 않습니다. 반대로 mongot_initialsync_* 및 mongot_index_stats_replication_initialSync_*와 같은 초기 동기화 특정 지표는 초기 동기화가 실행 중이거나 실행된 경우에만 유효합니다.
메트릭 | 유형 | 단위 | 설명 |
|---|---|---|---|
| 게이지 | 카운트 | 초기 동기화 대기열. 레이블: |
| 카운터 | 카운트 | 다시 재정렬된 초기 동기화를 임베딩합니다. 이 지표는 자동 임베딩을 구성할 때만 사용할 수 있습니다. |
| 게이지 | 카운트 | 현재 진행 중인 초기 동기화. 레이블: |
| 게이지 | 카운트 | 디스패쳐에 작업이 있는 초기 동기화. |
| 게이지 | 카운트 | 체크포인트에서 다시 시작된 진행 중인 동기화. |
| 게이지 | 0/1 | 활성화된 컬렉션 스캔 모드. 레이블: |
| 요약 | 초 | 동기화 완료 기간 분포. |
| 요약 | 초 | 진행 중인 동기화 기간. |
| 게이지 | 초 | 진행 중인 초기 동기화 기간의 최소값, 최대값 및 합계. |
| 카운터 | 카운트 | 온디스크 세그먼트를 읽을 수 없어 제거되었습니다. |
| 카운터 | 카운트 | 읽을 수 없는 세그먼트 후 복구되었습니다. 레이블: |
라이프사이클
메트릭 | 유형 | 단위 | 설명 |
|---|---|---|---|
| 게이지 | 카운트 | 현재 초기화 상태에 있는 인덱스. |
| 요약 | 초 | 초기화 시간. |
| 카운터 | 카운트 | 인덱스 다운로드가 실패했습니다. |
| 카운터 | 카운트 | 실패한 인덱스 제거 |
| 카운터 | 카운트 | 실패한 인덱스 초기화 |
구성 상태
메트릭 | 유형 | 단위 | 설명 |
|---|---|---|---|
| 게이지 | 카운트 | 현재 카탈로그에 있는 인덱스. 레이블: |
| 게이지 | 카운트 | 점진적으로 사라지는 인덱스. |
| 게이지 | 카운트 | 스테이징되었지만 아직 활성화되지 않은 인덱스. |
| 게이지 | 카운트 | 기능 버전-4-특정 대응물입니다. |
커서 및 인덱스 팩토리
이 지표를 사용하여 열린 커서 상태를 모니터링하고 온디스크 세그먼트가 읽을 수 없어 mongot 이 제거하거나 복구한 인덱스를 감지합니다.
메트릭 | 유형 | 단위 | 설명 |
|---|---|---|---|
| 게이지 | 카운트 | 현재 추적 중인 열린 커서. |
| 카운터 | 카운트 | 세그먼트를 읽을 수 없어 인덱스가 제거되었습니다. |
| 카운터 | 카운트 | 읽을 수 없는 세그먼트 후 복구. 레이블: |
Lucene 병합
이 지표를 사용하여 진행 중인 병합 수 및 크기, 병합 입력 및 출력 크기, 병합 기간, 및 디스크 사용률 병합 정책에 의해 패기된 병합을 포함하여 Lucene 세그먼트 병합 작업을 모니터링합니다.
메트릭 | 유형 | 단위 | 설명 |
|---|---|---|---|
| 게이지 | 카운트 | 활성 병합. 레이블: |
| 게이지 | 카운트 | 현재 병합 중인 문서. |
| 카운터 | 카운트 | 스타트업 이후 실행된 총 병합 횟수입니다. |
| 카운터 | 카운트 | 병합으로 접힌 세그먼트. |
| 요약 | 바이트 | 병합 입력 크기 분포. |
| 요약 | 바이트 | 병합 출력 크기의 분포. |
| 요약 | 카운트 | 병합 분포당 문서. |
| 요약 | 초 | 병합 기간 분포. |
| 카운터 | 카운트 | 디스크 사용량 인식 정책에 의해 패기된 병합. |
MongoDB 클라이언트 연결 풀 지표
mongot mongod에 여러 개의 이름을 가진 연결 풀을 열고 각 풀에 clientName 레이블을 지정하여 각 풀의 역할을 식별합니다. 다음 표에는 사용 가능한 clientName 레이블 값과 해당 역할이 나열되어 있습니다.
clientName | 목적 |
|---|---|
| 정상 상태 변경 스트림 복제. |
| 초기 동기화 및 세션 새로 고침. |
| 내부 메타데이터 서비스. |
| optime 폴링. |
| 데이터베이스 메타데이터 검색. |
| 서버 정보 검색. |
| 리스 관리자. |
| 자동화된 임베딩 쓰기 (write). 이 연결 풀은 자동화된 임베딩을 구성할 때만 나타납니다. |
다음 표에는 mongot 연결 풀에 사용할 수 있는 지표가 나열되어 있습니다.
메트릭 | 유형 | 단위 | 설명 |
|---|---|---|---|
| 게이지 | 카운트 | 풀에 현재 열린 연결. |
| 게이지 | 카운트 | 현재 체크아웃된 연결. |
| 게이지 | 카운트 | 구성된 최대 푸린 크기. |
| 게이지 | 카운트 | 구성된 최소 풀 크기. |
| 카운터 | 카운트 | 성공적인 네이티브 OpenSSL 링크 시도입니다. |
| 카운터 | 카운트 | 네이티브 OpenSSL 링크 시도 실패. |
동의어
이 지표를 사용하여 컬렉션 스캔, 스캔 및 동기화 기간, 큐 깊이, 동기화 시 발생한 예외 사항 등 유의어 동기화 활동을 모니터링합니다.
메트릭 | 유형 | 단위 | 설명 |
|---|---|---|---|
| 카운터 | 카운트 | 동의어에 대해 수행된 총 컬렉션 스캔. |
| 카운터 | 카운트 | 변경 스트림 이벤트에 의해 트리거된 동의어 검색. |
| 요약 | 초 | 스캔 기간 분포. |
| 요약 | 초 | 동기화 기간 분포. |
| 게이지 | 카운트 | 현재 동기화 동의어 큐 깊이입니다. |
| 카운터 | 카운트 | 동의어 동기화 예외. |
실행기 푸일
이 지표를 사용하여 mongot 이 배경 작업을 실행하는 명명된 실행기 푸를 모니터링합니다. 각 푸르는 푸르 이름을 접두사로 사용하여 동일한 섑세트의 하위 지표를 노출하므로 모든 푸르에 대해 스레드 활동, 푸르 크기, 큐 깊이, 작업 처리량, 작업별 실행 시간을 추적할 수 있습니다.
다음 표에는 모든 실행기 푸를 노출하는 하위 지표가 나열되어 있으며, <pool> 는 푸를 이름 접두사입니다. 모든 실행기 푸 하위 지표에는 name="executorMetrics" 레이블이 있습니다.
지표 서브 접미사 | 유형 | 설명 |
|---|---|---|
| 게이지 | 현재 작업을 실행 중인 스레드 |
| 게이지 | 푸린 크기 조정. |
| 게이지 | 스레드를 기다리는 작업 — 포화 신호. |
| 게이지 | 남은 큐 용량. |
| 카운터 | 스타트업 이후 완료된 작업입니다. |
| 요약 | 작업 간 유휴 시간을 사용하는 스레드. |
| 요약 | 작업별 실행 시간. |
| 카운터 | 예정 작업 개수(예정 풀의 경우). |
다음 표에는 사용 가능한 명명된 실행자 푸를의 접두사와 각 목적이 나열되어 있습니다.
실행자 푸를 접두사 | 실행 내용 |
|---|---|
| 블로브 저장 수명 주기 작업. |
| gRPC 서버 워커 스레드 차단. |
| 변경 스트림 모드 선택. |
| 변경 스트림 동기화 디스패치(안정 상태에서 가장 바쁜 작업 중 하나). |
| 구성-모니터 폴링. |
| 파이프라인 작업자 디코딩. |
| 디스크 모니터 폴링. |
| gRPC 상태 확인 타이머. |
| 유휴 커서 수확. |
| 인덱스 커밋 작업. |
| 인덱스 별 라이프사이클 작업. |
| Lucene IndexReader 새로 고침. |
| 인덱싱 파이프라인 작업자(안정 상태에서 가장 바쁜 인덱싱 푸일). |
| 인덱싱 라이프사이클 작업 |
| 자동화된 임베딩 인덱싱 경로. 이 실행자 푸를은 자동화된 임베딩을 구성할 때만 표시됩니다. |
| 초기 시간 라이프사이클 작업. |
| 구체화된 뷰 추적 및 라이프사이클. 이러한 지표는 자동 임베딩 또는 다른 구체화된 뷰 기반 기능이 구성되어 있는 경우에만 사용할 수 있습니다. |
| optime 업데이터(배경). |
| 세션 새로 고침. |
| 시스템 지표 업데이터. |
팁
모든 실행자 푸린의 포화 모니터링
모든 실행기 풀의 포화를 모니터링하려면 다음 PromQL 쿼리를 실행하세요.
max by (pool) ( label_replace( {__name__=~"mongot_.+_executor_queued_tasks"}, "pool", "$1", "__name__", "mongot_(.+)_executor_queued_tasks" ) )
이 쿼리는 각 실행기 푸릴의 대기 중인 작업 개수를 반환합니다.
Prometheus 서버 자체 지표
mongot의 내장된 Prometheus 서버에서 다음 지표를 사용할 수 있습니다.
메트릭 | 유형 | 단위 | 설명 |
|---|---|---|---|
| 요약 | 초( |
|
구성별 지표
다음 지표 패밀리는 특정 기능을 활성화할 때에만 /metrics 출력에 표시됩니다.
지표 패밀리 | 설명 | 자체 관리형에서의 가용성 mongot |
|---|---|---|
| 자동 임베딩과 관련된 지표입니다. 예를 들어 | 자동 임베딩을 구성하는 경우에만 표시됩니다. |
| FTDC 실행자의 실패 카운트. |
|
PromQL 예시
이 카탈로그의 대부분의 지연 시간 지표는 히스토그램이 아닌 요약이므로, 게시된 quantile 레이블이 있는 경우 직접 사용하세요. mongot_index_stats_query_limitPerQuery 및 mongot_index_stats_query_numCandidatesPerQuery와 같이 더 적은 수의 지표는 히스토그램이며 _bucket 계열을 노출합니다.
# Replication state max by (state) (mongot_replication_mongodb_indexManagerState) # Number of search indexes at STEADY_STATE replication mongot_replication_mongodb_indexManagerState{state="STEADY_STATE"} # Maximum replication lag across all indexes, converted to seconds max(mongot_index_stats_indexing_replicationLagMs) / 1000 # Index count by status count by (status) (mongot_index_stats_indexStatusCode == 1) # Search query p99 latency across all indexes max(mongot_index_stats_query_searchResultBatchLatencies_seconds{quantile="0.99"}) # Worst recent GC pause max(mongot_jvm_gc_pause_seconds_max) # Average GC pause over 5 minutes rate(mongot_jvm_gc_pause_seconds_sum[5m]) / rate(mongot_jvm_gc_pause_seconds_count[5m]) # Free disk percentage on dataPath mongot_system_disk_space_data_path_free_bytes / mongot_system_disk_space_data_path_total_bytes # Major page fault rate rate(mongot_system_process_majorPageFaults_operations[5m]) # Steady-state and initial sync exceptions over 15 minutes sum(rate(mongot_index_stats_indexing_steadyStateExceptions_total[15m])) sum(rate(mongot_index_stats_indexing_initialSyncExceptions_total[15m]))