Skip to main content
简体中文版经机器翻译而成,仅供参考。如与英语版出现任何冲突,应以英语版为准。

使用 Workload Factory 中的 Overview 仪表板进行 EDA

贡献者 netapp-sineadd

使用概述仪表板检查 FSx for ONTAP 文件系统的运行状况和容量。您可以过滤数据,查看容量建议,调整 SSD 和吞吐量设置,并查看性能趋势,以帮助决定在何处放置卷以及何时扩展容量。

开始之前

您必须具有 "已激活 Overview dashboard",然后才能使用它来监控文件系统。

筛选仪表板

使用仪表板顶端的筛选器查看特定的文件系统。筛选器适用于延迟、利用率、ONTAP 事件部分和集群表。

步骤
  1. 使用以下任一方式登录 "主机体验"

  2. 选择菜单 汉堡菜单图标,然后选择 EDA

  3. 选择 Overview 选项卡。

  4. 使用可用的筛选器来缩小视图范围:

    • AWS 账户:按与您配置的凭据关联的一个或多个 AWS 账户进行筛选

    • 凭据:如果配置了多个 AWS 凭据,请按特定 AWS 凭据进行筛选

    • 区域:按一个或多个 AWS 区域筛选

  5. 更新筛选器选择时,将刷新所有信息以仅显示匹配的文件系统。

查看集群运行状况状态

在控制面板的顶端,您可以看到所选文件系统的运行状况和活动摘要。仅当至少一个 FSx for ONTAP 链接连接到您的文件系统时,才会显示此内容。

关于此任务

集群运行状况状态包括以下关键领域:

  • 延迟:检测到的延迟事件数量

  • 文件系统弹性

    • SSD capacity:显示有多少文件系统使用 Automate、Recommend 或 None 来管理 SSD 容量。

    • 吞吐量:显示有多少文件系统使用 Automate、Recommend 或 None 来管理吞吐量。

  • ONTAP 事件:按类别(容量、可用性和保护、安全性和其他)划分的 EMS 事件数量

步骤
  1. 查看控制面板顶部的集群运行状况状态。

  2. 要查看延迟事件:

    • 选择 Review 以导航到 Latency 选项卡

    • 如果未配置延迟监控,请选择 Configure 设置延迟阈值

      有关延迟监控的详细信息,请参阅 "配置延迟监控"

  3. 要查看 FSx for ONTAP 文件系统的 ONTAP 事件,请选择*查看*。

    ONTAP 事件视图卡按类别(容量、可用性和保护以及安全性和其他)显示 EMS 事件的数量。有关监测的 EMS 事件的完整列表,请参见 "ONTAP CLI 文档"

查看和应用容量或吞吐量建议

Workload Factory 会自动为每个 FSx for ONTAP 文件系统运行建议。您可以通过筛选"集群"表来查找包含建议的文件系统。

步骤
  1. 在*集群*表中,按相关时间或详细信息列进行筛选。

    具有容量或吞吐量建议的文件系统显示在表格顶部。

  2. 在表中选择文件系统名称以打开集群详细信息。

  3. 请查看推荐和图表。

    该建议解释了建议的变更及其背后的原因。例如:我们建议根据您的文件系统 SSD 使用模式增加 SSD 大小。

    该图表显示了当前的使用情况以及历史趋势。

  4. 在图表的右上角,选择时间范围以更改显示的时间段。

    该图还显示推荐决策点和自动化决策点(如果启用了自动化模式)。将鼠标悬停在任何决策点上,以查看此时有关容量建议或自动化操作的详细信息。

  5. 要应用推荐,请按照推荐消息中提供的指导进行操作。

更改 SSD 管理模式

对于每个文件系统,选择 SSD 容量的管理方式:接收手动建议或允许自动扩展。

步骤
  1. 在 Clusters 表中找到文件系统名称。在其旁边,打开 操作菜单图标 并选择 更改 SSD 容量管理

  2. 选择 Enable SSD capacity management,然后选择 Apply

  3. 选择您的首选模式:

    • 仅通知(推荐模式)

    • 自动化

  4. 配置 SSD 容量管理参数:

    • 阈值 (%):触发建议的 SSD 使用百分比

    • Lookback (%):用于分析的历史使用数据周期

    • Lookahead (%):未来容量规划的预计使用量

  5. 选择*应用*。

结果

文件系统立即切换到新模式。如果选择"推荐"或"自动",系统将使用设置来分析存储容量并做出决策。

更改吞吐量管理模式

对于每个文件系统,选择如何管理吞吐量增加。

步骤
  1. 在*概述*选项卡中,在集群表中选择一个或多个文件系统。

  2. 选择*更改吞吐量管理*。

  3. 选择*启用吞吐量管理*,然后选择*应用*。

  4. 选择您的首选模式:

    • 仅通知(推荐模式)

    • 自动化

  5. 在对话框中,配置吞吐量管理参数:

    • 评估窗口(小时):分析吞吐量模式的时间段

    • Breached metrics (%):用于确定违规行为的百分比阈值

    • 连续违规窗口(小时):行动前连续违规的持续时间

    • 最小延迟(毫秒):用于确定吞吐量增加的延迟阈值

    • 最大吞吐量 (SKU):允许的最大吞吐量 SKU

  6. 选择*应用*。

结果

选定的文件系统立即切换到新的吞吐量模式。

批量编辑管理参数

同时更改多个文件系统的设置,以便在集群中应用相同的设置。

步骤
  1. 概述 选项卡中,选择要在表中编辑的文件系统。

    提示 您可以选择单个文件系统,也可以使用标题复选框来选择所有可见的文件系统。
  2. 选择表上方的 Change SSD capacity managementChange throughput management

  3. 选择您的首选模式。

  4. 在"编辑"对话框中,根据需要调整参数。

    每个参数字段都包含一个工具提示,描述其目的和有效范围。该对话框根据您的选择显示当前值或默认值。

  5. 选择 Apply 将更改应用于所有选定的文件系统。

结果

将更新所有选定文件系统的参数。处于"推荐"或"自动化"模式下的文件系统将立即使用新参数进行分析和决策。

使用 SSD 使用情况图表可查看存储使用情况如何随时间变化并发现规律。

关于此任务

图表上的决策点表示何时:

  • 推荐决策点:容量推荐算法确定需要额外的 SSD 容量。

  • 自动化决策点:自动化系统试图增加 SSD 容量。这些点显示操作是成功还是失败。

步骤
  1. 概述 选项卡中,在表中选择一个文件系统名称。

  2. 查看显示历史容量趋势的 SSD 使用情况图。

  3. 选择不同的时间范围以查看不同时期的容量行为。

  4. 将鼠标悬停在图表上的决策点上,可查看特定时刻的建议或自动化操作的详细信息。

  5. 使用图表中的见解:

    • 了解需要调整容量的频率

    • 评估自动化或推荐模式是否更适合您的工作负载模式

    • 识别重复性容量限制

    • 根据增长趋势规划未来的容量需求

    • 对失败的自动化尝试进行故障排除

使用集群表

集群表提供了每个 FSx for ONTAP 文件系统的详细视图以及性能和使用指标。

步骤
  1. 概述 选项卡中,查看集群表。

  2. 使用搜索框按名称查找特定文件系统。

  3. 选择列标题以对数据进行排序。

  4. 使用 SSD 使用情况 来识别接近容量限制的文件系统。

  5. 使用 吞吐量使用率 (P99) 将吞吐量需求与配置的吞吐量 SKU 进行比较。

    将鼠标悬停在吞吐量列标题上以获取计算详细信息。

  6. 要自定义列,请选择列设置图标并选择要显示的列。

  7. 要导出数据,请选择导出图标以下载 CSV 文件。

最佳实践

使用概览控制面板时,请考虑以下建议:

  • 定期监控:经常检查仪表板,以便在出现问题之前发现趋势。

  • 设置明确的阈值:选择适合您的工作负载和容量计划的 SSD 使用阈值和吞吐量参数。

  • 使用筛选器:应用区域和帐户筛选器,将重点放在要审核的基础架构部分。

  • 快速查看建议:筛选集群表以查找具有容量或吞吐量建议的文件系统。检查并采取措施,以避免空间耗尽。

  • 选择正确的模式:如果要自己批准容量或吞吐量更改,请使用 Recommend 模式。如果您希望系统自动管理容量或吞吐量,请使用 Automate 模式。

  • 观察决策点:检查容量图表上的决策点,了解系统如何做出决策,并确认设置是否符合您的需求。

  • 批量编辑:管理多个文件系统时,请使用批量编辑以保持设置一致。