对于 AI 代理:可在 https://www.mongodb.com/zh-cn/docs/llms.txt 获取文档索引—通过在任何 URL 路径后添加 .md 可获取所有页面的 Markdown 版本。
Docs 菜单

查看可用的Ops Manager指标

您可以查看以下指标来监控您的部署。 所有硬件指标都包括最大值的指标或单独图表。

注意

仅当自动化托管进程时, Ops Manager才会收集硬件指标。监控代理只能收集数据库指标。

重要

可用的指标取决于您的用户角色和部署类型。

以下指标反映了MongoDB进程的性能和行为。

衡量标准
说明
Asserts

显示以下信息:

  • regular 显示所选样本周期内每秒触发的常规断言的平均速率。

  • warning 显示所选样本周期内每秒发出警告的平均速率。

  • msg 显示所选样本周期内每秒消息断言的平均速率。 这些内部服务器错误具有明确定义的文本字符串。 MongoDB Atlas 会记录这些堆栈跟踪。

  • user 显示所选样本周期内每秒用户断言的平均速率。该指标包括用户生成的断言,如磁盘空间不足或重复键错误。

监控器断言跟踪在尝试读取或写入数据时发生的错误数量。检查服务器日志,找出错误源。

Cache Activity

显示以下信息:

  • readInto 显示在所选示例周期内每秒读取 WiredTiger缓存的平均字节数。

  • writtenFrom 显示在所选示例周期内从 WiredTiger 的缓存写入的平均字节每秒速率。

监控缓存活动,追踪WiredTiger存储引擎缓存的写入吞吐量。

Cache Ratio

显示以下信息:

  • cache fill ratio 衡量缓存的填充程度。 Ops Manager通过将缓存中的当前字节数除以配置的最大字节数来计算此值,并将结果以百分比表示。缓存填充率接近 100% 表示查询工作集大于配置的缓存大小。增加缓存大小可以减少磁盘 I/O。

  • dirty fill ratio 表示脏数据字节(在内存中修改但尚未写入磁盘的页面)相对于总缓存的比例。高脏填充率表示有大量数据正在等待刷新到磁盘,这可能会影响性能。监控此指标的写入密集型工作负载,以确保数据持久性。

监控缓存比率,以确定缓存大小是否足以满足当前工作负载。

Cache Usage

显示以下信息:

  • used 显示WiredTiger缓存中当前的字节数。

  • dirty 显示WiredTiger缓存中当前跟踪的脏数据字节字节数。

监控缓存使用情况,以确定WiredTiger缓存是否已接近容量。

Catalog

显示以下信息:

  • total databases 显示非系统数据库的总数。

  • total collections 显示所有非系统数据库的集合总数。

  • total views 显示所有非系统数据库的视图总数。

  • total indexes 显示所有非系统集合的索引总数。

监控目录计数,防止过多的数据库、collection、视图或索引导致初创企业失败。

Connection Rate

显示以下信息:

  • connections net increase 显示连接数每秒净增长的速率。

  • connections net decrease 显示连接数每秒净减少的速率。

  • connections created 显示每秒创建连接的速率。

监控连接速率以追踪创建或删除连接的速度。

Connections

显示部署的活动连接总数。每个连接都使用自己的线程堆栈,因此大量连接可能会导致大量使用RAM 。

监控连接以确定当前的连接限制是否足够。

Cursors

显示以下信息:

  • totalOpen 显示服务器为客户端维护的游标数量。 由于 MongoDB 会耗尽未使用的游标,因此该值通常很小或为零。 但是,如果存在队列、过时的可追加游标或大量操作,则该值可能会上升。

  • timedOut 显示所选采样周期内每秒游标超时的平均速率。

监控游标以关闭不必要的游标,并减小应用程序中的超时配置。

DB Storage

显示以下信息:

  • storageSize 显示为所有数据库中的文档存储分配的压缩磁盘存储空间的总和。

  • logicalDataSize W/System 显示所有数据库(包括系统数据库)中文档数据(包括填充因子)的未压缩总大小(以字节为单位)。

  • logicalDataSize 显示非系统数据库中文档数据(包括填充因子)的总未压缩大小(以字节为单位)。

  • indexSize 显示所有数据库中索引数据的总逻辑大小(以字节为单位)(包括前缀压缩)。

  • totalDatabases 显示数据库总数。

  • totalCollections 显示所有数据库中的集合总数。

  • totalViews 显示所有数据库的视图总数。

  • totalIndexes 显示所有集合的索引总数。

监控存储空间以确定是否手动增加磁盘大小。

Document Metrics

显示以下信息:

  • returned 显示所选示例期内查询返回的文档的平均每秒速率。

  • inserted 显示所选示例周期内每秒插入文档的平均速率。

  • updated 显示所选示例周期内更新文档的平均每秒速率。

  • deleted 显示所选示例期内每秒删除文档的平均速率。

监视文档指标以衡量 MongoDB 完成的工作。

Memory

显示特定时间点的内存总消耗量(以兆字节为单位):

  • resident displays the number of megabytes of resident memory used by the mongod process. For WiredTiger deployments, this includes the WiredTiger cache plus memory used by other in-memory mongod structures. By default, mongod with WiredTiger reserves 50% of total physical memory for the cache.

  • virtual displays the virtual megabytes for the mongod process. If virtual is much larger than mapped memory, the mongod process may use excessive memory for other purposes, such as connection thread stacks.

  • mapped 显示所有数据文件的 MMAPv1 内存映射的数量。此数字可能与数据库总大小相似。 WiredTiger不使用内存映射文件,因此该值为 0。

监控内存以确定当前部署是否满足内存需求。

Network

显示以下信息:

  • bytesIn 显示在所选样本周期内每秒发送至该数据库服务器的物理字节的平均速率(经过任何线路压缩后)。

  • bytesOut 显示在所选样本周期内每秒从该数据库服务器发送的物理字节的平均速率(经过任何线路压缩后)。

  • numRequests 显示在所选样本时间段内每秒发送到该数据库服务器的平均请求率。

监控网络指标以追踪网络性能。

OpCounters

显示以下信息:

  • command 显示所选示例周期内每秒执行命令的平均速率。

  • query 显示所选示例周期内每秒执行查询的平均速率。

  • insert 显示所选示例周期内每秒执行插入的平均速率。

  • delete 显示所选示例周期内每秒执行删除的平均速率。

  • update 显示所选示例周期内每秒执行的平均更新速率。

  • getmore 显示所选示例周期内任何游标每秒执行 getMores 的平均速率。在主节点 (primary node in the replica set)上,即使查询计数较低,此值也可能很高,因为作为复制的一部分,从节点会从主节点 (primary node in the replica set)获取更多内容。

  • ttldeleted 显示所选示例周期内每秒执行的TTL删除的平均速率。 TTL删除仅应用于主节点 (primary node in the replica set),并会复制到从节点。

监控 MongoDB 操作以验证与高工作负载相关的性能问题。确认负责负载的操作类型。

Operation Execution Times

显示以下信息:

  • avg ms/read 显示所选示例周期内每次读取操作的平均执行时间(以毫秒为单位)。

  • avg ms/write 显示所选示例周期内每个写入操作的平均执行时间(以毫秒为单位)。

  • avg ms/write w/o flow control 从总数中减去流量控制的影响后,显示所选示例周期内每次写入操作的平均执行时间(以毫秒为单位)。

  • avg ms/command 显示所选示例周期内每个命令操作的平均执行时间(以毫秒为单位)。

监控操作执行时间,识别慢速操作和潜在的性能瓶颈。

Operation Throttling

显示以下信息:

  • rejected 显示一段时间内因与用户定义的拒绝过滤匹配而被拒绝的操作数。这些筛选器可防止由于查询效率低下或资源限制而导致的集群降级。您可以通过运行查询设置命令设立这些筛选器。

  • killed 显示一段时间内由于超过默认集群超时而被终止的读取操作的数量。此超时可防止无意中长时间运行的查询消耗过多数据库资源。在操作级别设立的超时会覆盖集群级别的超时。

监控操作限制以识别被拒绝或终止的查询。

Page Faults

显示所选样本周期内该进程每秒的平均页面错误率。在非 Windows 环境中,这种情况只适用于硬页面错误。

监控页面错误,以确定是否增加内存。

Queues

显示以下信息:

  • total 显示排队和等待任何锁的操作数。

  • readers 显示排队和等待读锁(read lock)的操作数。

  • writers 显示排队和等待写锁(write lock)的操作数。

监控队列以识别潜在问题和瓶颈。

Query Executor

显示以下信息:

  • scanned displays the average rate per second over the selected sample period of index items scanned during queries and query-plan evaluation. This rate is driven by the same value as totalKeysExamined in the output of explain().

  • scanned objects displays the average rate per second over the selected sample period of documents scanned during queries and query-plan evaluation. This rate is driven by the same value as totalDocsExamined in the output of explain().

监控查询执行器,识别扫描过多索引或文档的低效查询。

Query Targeting

显示在 MongoDB 上运行的读取操作的效率:

  • scanned / returned 显示自所选示例周期的上一个数据点以来扫描的索引项数与查询返回的文档数的比率。值为 1.0 表示所有返回的文档与查询条件完全匹配。值越高,表示查询为每个返回的文档扫描的索引项越多。

  • scanned objects / returned 显示自所选示例周期的上一个数据点以来扫描的文档数与查询返回的文档数的比率。

监控查询目标,以确定读取效率,优化查询和索引。

Scan and Order

显示返回排序结果且无法使用索引执行排序操作的查询在选定示例周期内的平均每秒速率。

监控该指标以确定查询是否需要索引。

Shard Data Size

显示您存储的数据在每个分片上使用的存储空间量(以字节为单位)。您只能在使用MongoDB 6.0+ 的分片的片集群的分分片的命名空间视图中访问权限此图表。

监控此指标以验证分片是否均衡。

Shard Document Count

显示每个分片上的文档数量。您只能在使用MongoDB 6.0+ 的分片的片集群的分分片的命名空间视图中访问权限此图表。

监控此指标以验证分片是否均衡。

Tickets Available

显示以下信息:

  • read 显示WiredTiger存储引擎可用的读取票证数量。读取票证表示允许进入存储引擎的并发读取操作的数量。当该值达到零时,新的读取请求可能会排队,直到有读取票证可用。

  • write 显示WiredTiger存储引擎可用的写入票证数量。写入票证表示允许进入存储引擎的并发写入操作数。当该值达到零时,新的写入请求可能会排队,直到有写入票证可用。

监控可用票证,以确定可能影响性能的存储引擎并发约束。

以下指标反映了部署中各个数据库的统计信息。

衡量标准
说明
Avg Object Size

显示数据库中所有集合的平均对象大小。

监视对象大小以追踪对象的大小并更好地了解数据库空间。

Collections

显示数据库中的集合数。

监控集合以确定重新启动时间、连续备份性能和稳定性。

Data Size

显示数据库中数据文件的实际大小。

监控数据大小,确保数据库没有使用过多内存或 CPU。

Index Size

显示数据库中所有索引的总大小。除了索引所依据的实际文档数据之外,该指标还包括索引所产生的开销。

监控索引大小以管理索引。如要了解更多信息,请参阅索引策略

Indexes

显示数据库中的索引总数。

监控索引以对索引进行管理。如要了解更多信息,请参阅索引策略

Num Extents

显示为数据库连续分配的数据文件空间的数据块总数。

监控该指标以更好地了解数据库空间。

Objects

显示数据库中的对象数量。

监控该指标以更好地了解数据库空间。

Storage Size

显示数据库的存储大小。

监控存储大小以确定是否手动增加磁盘大小。

Views

显示数据库中视图的数量。

监控视图以更好地了解数据库空间。

以下指标反映了支持部署的托管的性能和使用情况。

衡量标准
说明
Disk IOPS

显示以下信息:

  • read iops 显示用于MongoDB的磁盘分区的每秒 I/O 操作读取吞吐量。

  • write iops 显示用于MongoDB的磁盘分区的每秒 I/O 操作写入吞吐量。

监控磁盘 IOPS 是否接近预配的最大 IOPS。 确定部署是否可以处理未来的工作负载。

Disk Latency

显示以下信息:

  • read latency 显示从磁盘读取的平均时间。

  • write latency 显示写入磁盘的平均时间。

  • max read latency 显示指标粒度指定的时间段内的最大磁盘读取延迟值。

  • max write latency 显示指标颗粒度指定的时间段内的最大磁盘写入延迟值。

监控磁盘延迟以跟踪读取和写入磁盘的效率。

Disk Queue Depth

显示向存储 MongoDB 数据的磁盘分区发出的请求队列的平均长度。

监控磁盘队列深度,找出潜在问题和瓶颈。

Disk Space Free

显示以下信息:

  • disk space free 显示MongoDB使用的磁盘分区上可用磁盘空间的总字节数。

  • max disk space free 显示指标粒度指定的时间段内的最大可用磁盘空间值。

监控可用磁盘空间,以确定是否使用磁盘自动伸缩还是手动增加磁盘大小。

Disk Space Percent Free

显示以下信息:

  • percent disk space free 显示MongoDB使用的分区上可用磁盘空间的百分比。

  • max percent disk space free 显示指标粒度指定的时间段内的最大可用磁盘空间百分比值。

监控可用磁盘空间的百分比,以确定是否使用磁盘自动伸缩或手动增加磁盘大小。

Disk Space Used

显示以下信息:

  • disk space used 显示运行MongoDB 的分区上已用磁盘空间的总字节数。

  • max disk space used 显示指标颗粒度指定的时间段内的最大已用磁盘空间值。

监控已用磁盘空间,以确定是否手动增加磁盘大小。

Max Disk IOPS

显示指标颗粒度指定的时间段内的以下最大磁盘 IOPS 值:

  • max read iops 每秒最大磁盘读取输入操作数。

  • max write iops 每秒最大磁盘写入输入操作数。

监控磁盘 IOPS 是否接近预配的最大 IOPS。 确定部署是否可以处理未来的工作负载。

Max Disk Queue Depth

显示指标颗粒度指定的时间段内的最大磁盘队列深度值。 磁盘队列深度是向存储 MongoDB 数据的磁盘分区发出的请求队列的平均长度。

监控磁盘队列深度,找出潜在问题和瓶颈。

Max Normalized System CPU

显示节点上所有进程的最大 CPU 使用率值,通过除以 CPU 核心数,调整范围为 0-100%:

  • user 显示指标颗粒度指定的时间段内的最大规范化系统用户 CPU 值。

  • kernel 显示指标粒度指定的时间段内的最大规范化系统内核 CPU 值。

  • nice 显示指标粒度指定的时间段内的最大规范化系统良好 CPU 值。

  • iowait 显示指标粒度指定的时间段内的最大规范化系统 IO 等待 CPU 值。

  • irq 显示指标颗粒度指定的时间段内的最大规范化系统 IRQ CPU 值。

  • softirq 显示指标颗粒度指定的时间段内的最大规范化系统 SoftIRQ CPU 值。

  • guest 显示指标粒度指定时间段内的最大规范化系统客户机 CPU 值。

  • steal 显示指标颗粒度指定的时间段内最大规范化系统窃取 CPU 值。

监控 CPU 使用情况,以确定是否从磁盘而不是内存中检索数据。

Max Process CPU

显示指标颗粒度指定的时间段内的以下最大进程 CPU 值:

  • max user 显示 CPU 用于处理 MongoDB 进程的最大时间百分比。

  • max kernel 显示 CPU 为 MongoDB 进程提供操作系统调用服务所花费的最大时间百分比。

监控 CPU 使用情况,以确定是否从磁盘而不是内存中检索数据。

Max System CPU

显示节点上所有进程的最大 CPU 使用率值:

  • user 显示指标粒度指定的时间段内的最大系统用户 CPU 值。

  • kernel 显示指标粒度指定的时间段内的最大系统内核 CPU 值。

  • nice 显示指标粒度指定的时间段内的最大系统良好 CPU 值。

  • iowait 显示指标粒度指定的时间段内的最大系统 IO 等待 CPU 值。

  • irq 显示指标颗粒度指定的时间段内的最大系统 IRQ CPU 值。

  • softirq 显示指标颗粒度指定的时间段内的最大系统 SoftIRQ CPU 值。

  • guest 显示指标粒度指定的时间段内的最大系统客户机 CPU 值。

  • steal 显示指标颗粒度指定的时间段内的最大系统窃取 CPU 值。

监控 CPU 使用情况,以确定是否从磁盘而不是内存中检索数据。

Max System Memory

显示最大系统内存值(以字节为单位):

  • used 显示指标颗粒度指定的时间段内的最大系统内存已用值。

  • available 显示指标粒度指定的时间段内的最大系统内存可用值。

  • free 显示指标粒度指定的时间段内的最大系统可用内存值。

  • shared 显示指标颗粒度指定的时间段内的最大系统内存共享值。

  • buffers 显示指标粒度指定的时间段内的最大缓冲区值。

  • cached 显示指标粒度指定的时间段内的最大缓存值。

监控内存以确定当前部署是否满足内存需求。

Normalized Process CPU

显示以下信息:

  • user 显示 CPU 为 MongoDB 进程提供服务所花费时间的百分比,除以 CPU 核心数后的范围为 0-100%。

  • kernel 显示 CPU 响应 MongoDB 进程的操作系统调用所占用时间的百分比,除以 CPU 内核数后的范围为 0-100%。

  • max user 显示指标颗粒度指定的时间段内的最大规范化进程用户 CPU 值。

  • max kernel 显示指标颗粒度指定的时间段内的最大规范化进程内核 CPU 值。

监控 CPU 使用情况,以确定是否从磁盘而不是内存中检索数据。

Normalized System CPU

显示节点上所有进程的 CPU 使用率,通过除以 CPU 核心数,调整范围为 0-100%:

  • user 显示 CPU 为所有用户应用程序(不仅仅是MongoDB进程)提供服务所花费的时间百分比,通过除以 CPU 核心数,范围为 0-100%。

  • kernel 显示 CPU 为来自所有进程的操作系统调用提供服务所花费的时间百分比,通过除以 CPU 核心数,范围为 0-100%。

  • nice 显示所有具有正nice值的进程占用 CPU 的时间百分比,通过除以 CPU 核心数,调整范围为 0-100%。

  • iowait 显示 CPU 等待 IO 操作完成所花费的时间百分比,通过除以 CPU 核心数,调整范围为 0-100%。

  • irq 显示 CPU 执行硬件中断所花费的时间百分比,通过除以 CPU 核心数,计算范围为 0-100%。

  • softirq 显示 CPU 执行软件中断所花费的时间百分比,通过除以 CPU 核心数,计算范围为 0-100%。

  • guest 显示用于为客户机提供服务的 CPU 时间百分比(包含在用户中),通过除以 CPU 核心数,范围为 0-100%。

  • steal 显示 CPU 具有可运行功能但虚拟机监控程序选择运行其他内容的时间百分比,通过除以 CPU 核心数,调整范围为 0-100%。

监控 CPU 使用情况,以确定是否从磁盘而不是内存中检索数据。

Process CPU

显示以下信息:

  • user 显示 CPU 用于 MongoDB 进程的时间百分比。

  • kernel 显示 CPU 为 MongoDB 进程提供操作系统调用服务所花费的时间百分比。

监控 CPU 使用情况,以确定是否从磁盘而不是内存中检索数据。

Swap IO (Internal)

显示操作系统在RAM和磁盘之间交换内存页面的速率:

  • swapped pages in / sec 显示操作系统每秒从交换区读入内存的页面数量。

  • swapped pages out / sec 显示操作系统每秒从内存写入交换的页面数量。

  • max swapped pages in 显示指标粒度指定的时间段内的最大交换页面值。

  • max swapped pages out 显示指标粒度指定的时间段内的最大交换页面输出值。

交换 IO 的高速率或持续速率可能与托管上的延迟和内存压力增加相关。

使用此指标可了解托管执行交换输入和输出操作的频率。

Swap Usage

显示有关托管上交换空间的以下信息:

  • used 显示当前正在使用的交换空间总量。

  • free 显示仍然可用的交换空间总量。

  • max used 显示所选时间段内使用的交换空间的最大总量。

  • max free 显示所选时间段内的最大可用交换空间量。

交换空间使用率持续较高可能表明托管存在内存压力。

监控交换使用情况,以确定操作系统何时开始将内存页面移动到磁盘。

System CPU

显示节点上所有进程的 CPU 占用率:

  • user 显示 CPU 为所有用户应用程序(不仅仅是MongoDB进程)提供服务所花费的时间百分比。对于具有超过 1 个 CPU 核心的服务器,此值可能会超过 100%。

  • kernel 显示 CPU 为所有进程的操作系统调用提供服务所花费的时间百分比。对于具有超过 1 个 CPU 核心的服务器,此值可能会超过 100%。

  • nice 显示所有具有正值的进程占用 CPU 的时间百分比。对于具有超过 1 个 CPU 核心的服务器,此值可能会超过 100%。

  • iowait 显示 CPU 等待 IO 操作完成所花费的时间百分比。对于具有超过 1 个 CPU 核心的服务器,此值可能会超过 100%。

  • irq 显示 CPU 执行硬件中断所花费的时间百分比。对于具有超过 1 个 CPU 核心的服务器,此值可能会超过 100%。

  • softirq 显示 CPU 执行软件中断所花费的时间百分比。对于具有超过 1 个 CPU 核心的服务器,此值可能会超过 100%。

  • guest 显示 CPU 为客户机提供服务所花费的时间百分比,该百分比包含在用户中。对于具有超过 1 个 CPU 核心的服务器,此值可能会超过 100%。

  • steal 显示 CPU 具有可运行某些内容但虚拟机监控程序选择运行其他内容的时间百分比。对于具有超过 1 个 CPU 核心的服务器,此值可能会超过 100%。

监控 CPU 使用情况,以确定是否从磁盘而不是内存中检索数据。

System Memory

显示以下信息:

  • used 显示使用中的物理内存字节数。

  • available 显示在不进行交换的情况下可用于运行新应用程序的系统内存字节数的估计值。

  • free 显示系统可用的未使用物理内存的字节数。

  • shared 显示多个进程之间共享的已用共享内存的字节数,包括RAM磁盘、SYS-V-IPC 和类似 BSD 的 SHMEM。

  • buffers 显示用于临时存储原始磁盘块的缓冲区缓存的字节数。

  • cached 显示页面缓存中的字节数。

监控内存以确定当前部署是否满足内存需求。

System Network

显示以下信息:

  • network bytes in 显示网络接口的平均接收速率(每秒的物理字节数)。

  • network bytes out 显示网络接口的平均发送速率(每秒的物理字节数)。

  • max network bytes in 显示指标粒度指定的时间段内的最大网络接收字节数值。

  • max network bytes out 显示指标粒度指定的时间段内的最大网络发送字节数值。

监控网络指标以追踪网络性能。

The following metrics are available for mongot (Search and Vector Search) nodes deployed through the MongoDB Enterprise Kubernetes Operator. Ops Manager displays these metrics in the mongot Details view. To learn more, see View Search Node Performance Metrics.

衡量标准
说明

CPU Usage

显示 mongot 进程的正常化 CPU 使用百分比。

JVM Memory

显示 mongot 进程的 Java 虚拟机(JVM)堆内存使用量和最大堆容量。使用此图表来识别可能影响搜索性能的内存压力。

JVM GC Pause

显示最大 Java虚拟机(JVM) 垃圾回收暂停持续时间(以秒为单位)。频繁或长时间的暂停会影响搜索查询延迟。

Disk Space Used

显示 mongot 进程使用的磁盘空间百分比。

Index Size

显示 mongot 进程上所有搜索索引的合并大小(以字节为单位)。

Index Documents

显示 mongot 进程上所有搜索索引的文档总数。

Index Segments

显示 mongot 进程上所有搜索索引的 Lucene 段总数。

Search Query Throughput

显示搜索查询的总速率和失败率(操作数/秒)。

Search Query Latency

以毫秒为单位显示搜索命令的平均和最大延迟。

Vector Search Throughput

显示每秒操作的向量搜索查询的总速率和失败率。

Vector Search Latency

以毫秒为单位显示向量搜索命令的平均和最大延迟。

Index Manager Health

显示以下各种状态的索引经理数量:STEADY_STATEFAILEDFAILED_EXCEEDED