重要
逐步推出
新的指标用户界面正在逐步推出到选定的新 Atlas 组织。在此推出过程中,该体验仅适用于符合条件的组织,并可能会继续发展。
Overview
新的指标用户界面是项目级 Atlas 指标体验的重大重新设计,可提供集群健康和性能的统一视图。重新设计的用户界面将硬件指标、MongoDB 进程指标、DBStats、搜索节点指标和分片指标从集群级别整合到单个节点。
主要改进包括:
统一指标视图:在单一集成界面中访问整个集群的硬件、MongoDB、DBStats、搜索节点和分片指标。取代上一个在集群、分片和托管级别指标的独立页面之间进行导航的体验。
增强过滤:按节点、分片、时间范围和特定指标类别过滤指标。
改进的导航:通过重新设计的集群级顶部导航以及更新的 Real-Time Performance Panel (RTPP) 和主机网络探测(ping)导航查看指标。
事件覆盖:在指标图表上直接查看数据库事件,以将性能变化与系统事件关联起来。
灵活的显示选项:在列表和表格视图之间切换、调整图表设置并自定义监控体验。
可用性
新的指标用户界面目前仅适用于:
选择新 Atlas 组织:在逐步推出过程中创建的组织会自动使用新的指标用户界面。
Atlas 云部署:新的指标用户界面适用于 Atlas 项目级别的指标页面。它不会影响 Cloud Manager、生产政府环境、Atlas Internal 或免费或 Flex 层级的指标页面。
注意
现有 Atlas 项目会继续使用旧版指标用户界面。新的指标用户界面将随着时间的推移向更多组织和项目提供。
切换到旧版指标用户界面
如果您的组织可以访问新的指标用户界面,则可以按用户切换回旧版指标用户界面:
要再次使用新的指标用户界面,请清除浏览器缓存,或在查看旧版指标用户界面时单击切换回去的选项。
访问新的指标用户界面
使用新用户界面访问指标:
在Atlas中,转到项目的 Clusters 页面。
如果尚未显示,请从导航栏上的 Organizations 菜单中选择包含所需项目的组织。
如果尚未显示,请从导航栏的Projects菜单中选择所需的项目。
在侧边栏中,单击 Database 标题下的 Clusters。
会显示集群页面。
新的指标用户界面在页面顶部显示增强的导航和过滤器控件。
集群级导航变更
由于现在可以在集群级别使用指标页面,因此现在可以从集群级别的从节点(secondary node from replica set)导航中使用相关监控页面,以提高可发现性:
- Real Time
- 现在可以从集群级导航访问 Real-Time Performance Panel。它包含节点过滤器,可用于查看每个节点的实时信息。
- Last Ping 和 Daily Pings
- 这些页面以前依赖于指标页面导航,现在可在集群级别的从节点(secondary node from replica set)导航中使用。
合并导航使得可以更容易在每个集群内的单一位置访问所有监控和性能工具。
新功能和特性
新的指标用户界面引入了多项增强功能:
图表图例和布局
每个图表组在组的底部显示图例。只要图表组在视图中,图例就会在页面上保持固定。工具提示值以降序显示,以便于比较。
过滤器和选择
- Filter by Shards and Nodes
将指标过滤到集群内的特定分片或单个节点。
对于集群和副本集集群:
过滤器默认为初次使用者的主节点 (primary node in the replica set)系列。
您的选择将保留以供后续访问使用。
分片和节点名称使用抽象命名(非完整主机名称)。
选择单个节点或查看所有节点的指标。
旧版用户界面还具有功能相似的节点过滤器。
对于具有解耦搜索架构的搜索节点:
搜索节点在选择器中分开显示。
搜索节点名称遵循以下模式:
search-{shardNo}-{randomString}。搜索节点用独特的图标标识。
单独选择搜索节点,或使用 Select All 进行快速选择。
- Date and Time
- 设置指标显示的自定义日期和时间范围。该接口支持预设时间范围(上一小时、上一天等)和自定义日期或时间选择。
- Select Metrics
使用指标选择器从仪表盘添加或删除指标组。
指标组织:指标选择器将指标组织成分类,并在默认情况下全部展开。
默认选择:首次使用的用户默认显示 Essential 类别。
持久选择:用户界面会为后续访问保留您选择的指标。
添加指标组:选择一个指标组,以将包含该组指标的图表卡添加到仪表盘。每个组通常包含多个图表。
单个图表选择:使用图表卡中的组级选择器从组中添加或删除单个图表。
指标说明:将鼠标悬停在任何指标上,即可在右侧面板中查看其说明。默认状态显示类别说明。
搜索功能:使用搜索过滤器筛选除 Essential 之外的所有类别,其中包含与其他类别重复的指标。
- Display Data
控制指标值的聚合和显示方式:
总和:显示指标的总和。
平均值:显示平均值。图例、图表和工具提示会相应更新。
最大值:显示最大值。
按分片汇总:显示按分片分组的指标值总和。
按分片平均:显示按分片分组的平均值。
按分片分组的最大值:显示按分片分组的最大值。
“按分片”选项在分片级别聚合数据,并根据您的托管选择显示每个分片的一个系列。更改显示数据设置会相应地更新所有图表显示、图例和工具提示。
- Event Overlays
切换事件覆盖,在指标图表上直接显示数据库事件。新的指标用户界面包含与旧版用户界面中可用的事件覆盖相同的事件覆盖:
托管重启:显示在受影响节点的时间序列行上。
选举:在受影响节点的时间序列行上显示。
将鼠标悬停在特定点上时,事件详情会在工具提示中显示。
显示控件
- Settings Drawer
- 通过设置抽屉访问图表粒度设置。
指标覆盖
全新的 Metrics 用户界面可以对多个指标类别进行全面监控:
硬件指标
硬件指标显示支持集群的主机的系统级别性能数据:
CPU 利用率和进程 CPU。
内存使用情况和可用内存。
磁盘 IOPS、磁盘空间和磁盘延迟。
网络吞吐量(输入或输出字节数)。
系统 CPU 和规范化 CPU 指标。
注意
所有硬件指标都有等效的突发报告,具有不同的可配置警报。要了解更多信息,请参阅突发报告。
MongoDB 指标
MongoDB 进程指标显示数据库服务器性能:
操作数/秒 (操作计数器)。
连接(当前和可用)。
查询执行指标。
复制延迟和oplog 指标。
游标统计信息。
插入、更新、删除和返回的文档的文档指标。
缓存指标。
队列指标。
断言指标。
页面错误指标。
MongoDB 内存指标。
MongoDB 网络指标。
数据库统计信息 (DBStats)
数据库级别统计提供存储和集合指标:
数据库和集合大小。
索引大小。
文档计数。
数据大小和存储大小。
集合、索引和视图的数量。
数据库选择器:使用数据库选择下拉菜单选择要查看其指标的数据库。默认选择 local 数据库。
注意
数据库统计信息会定期收集。有关集合频率和性能影响信息,请参阅查看 MongoDB 进程。
搜索节点指标
新用户界面会显示全套搜索指标,无论搜索部署类型如何:
搜索节点硬件指标。
搜索特定的进程指标。
搜索索引性能数据。
搜索工作负载的资源利用率。
搜索 Opcounters。
搜索节点的复制延迟。
索引统计信息(总数和性能指标)。
对于专用搜索节点(解耦搜索架构),搜索节点在拓扑结构选择器中显示为可选节点。除了搜索特定指标外,还可以查看这些节点的硬件指标。
对于同位搜索进程,搜索指标会根据所选托管进行显示。当选择具有同位 mongot 进程的托管时,搜索指标会反映该进程。
分析节点指标
分析节点可见性包括:
分析节点硬件性能。
分析节点上的查询性能。
资源消耗指标。
分片指标
对于分片集群,专用的分片指标类别显示:
分片数据分布。
分片集合计数。
集群集合计数。
mongos路由器指标。
分片集群可以使用“按分片”显示选项按分片聚合指标。分片的集群和副本集集群都可以使用相同的图表。
与旧版用户界面的行为差异
与旧版用户界面相比,新的指标用户界面包含几个行为变化:
节点和主节点或从节点过滤
新的用户界面在分片的和副本集集群中提供一致的节点选择:
单独选择节点或同时选择多个节点。
使用过滤器按分片成员身份进行筛选。
可视指示器显示节点角色:主节点 (primary node in the replica set)、从节点(secondary node from replica set)或仲裁节点。
这两种拓扑结构都使用相同的过滤接口,并为分片集群添加了额外的层次结构。
旧版用户界面的 Toggle Members 控件已被 Shards and Nodes 过滤器替换。
主节点或从节点系列:选择查看选举中主节点或从节点的指标。此选项允许您一致地追踪特定节点角色的指标,即使节点在选举过程中变更角色。例如,选择“主节点系列”将显示当前主节点的指标,从而在角色变更中保持连续性。
节点命名:在 Atlas 的新指标用户界面中,分片和节点名称是抽象的,而不是显示完整主机名称。抽象名称可提高可读性,并专注于逻辑集群结构。示例:
分片名称显示为
<cluster-alias>-shard-0、<cluster-alias>-shard-1等,其中,如果集群别名较长,则可以将其缩写。搜索节点显示为
search-{shardNo}-{randomString}。节点名称使用缩短的标识符,而不是完整的 Atlas 主机名称。
图表图例和工具提示使用这些缩写的节点名称以获取更清晰的显示。您可以使用图表图例中的复制按钮复制完整主机名称。
事件覆盖
事件覆盖可以开启或关闭,并在所有图表中同步。新的指标用户界面包含主机重启和选举事件,这些事件会显示在受影响节点的时间序列行上。
图表交互
增强的图表交互包括:
缩放控件:
放大:在任何图表上点击并拖动时间范围以放大。
缩小:使用顶级日期和时间或时间范围选择器调整视图。
图表组操作:
展开/折叠:展开图表组以显示所有指标,或折叠图表组以节省空间。
指标说明:单击信息图标以打开包含详细指标说明的模态。
关闭图表组:从仪表盘中删除一整组相关指标。
折叠状态:折叠后,图表组占用的空间极少,同时显示摘要信息。
单个图表操作:
- 关闭图表:从图表组中删除单个图表。
性能改进:
更好的移动设备和平板电脑响应能力。
更流畅的图表渲染和过渡。
针对多个图表的滚动进行了优化。
空状态消息
停用数据库统计信息集合时,新用户界面会显示:
清除解释数据不可用原因的空状态消息。
直接链接可在项目设置中启用集合。
关于启用集合对性能的影响的指导。
限制和范围
在逐步推出过程中应用以下限制:
支持的部署类型
新的指标用户界面可用于标准 Atlas 专用集群(M10 及以上)。
免费层级 (M0) 和共享层级 (M2 或 M5) 集群使用独立的指标用户界面。
Flex 集群有自己的专用指标视图。
环境范围
新的指标用户界面仅适用于:
Atlas 云托管部署。
项目级别指标页面。
它不会影响:
Cloud Manager 指标接口。
MongoDB 生产政府环境。
Atlas 内部指标。