在 StorageGRID 中创建自定义警报规则
您可以创建自定义警报规则,以定义自己的触发警报的条件。
-
您已使用 "支持的 Web 浏览器" 登录到网格管理器。
-
您熟悉 "常用的 Prometheus 指标"。
-
您了解 "Prometheus 查询的语法"。
-
或者,您已观看视频:
自定义提醒
StorageGRID 不验证自定义警报。如果您决定创建自定义警报规则,请遵循以下一般准则:
-
查看默认警报规则的条件,并将其用作自定义警报规则的示例。
-
如果为警报规则定义了多个条件,请对所有条件使用相同的表达式。然后,更改每个条件的阈值。
-
仔细检查每个条件是否有拼写错误和逻辑错误。
-
仅使用 Grid Management API 中列出的指标。
-
使用 Grid Management API 测试表达式时,请注意"成功"响应可能是空响应正文(未触发警报)。要查看警报是否实际触发,您可以暂时将阈值设置为当前预期为 true 的值。
例如,要测试表达式
node_memory_MemTotal_bytes < 24000000000,请先执行 `node_memory_MemTotal_bytes >= 0`并确保获得预期结果(所有节点都返回一个值)。然后,将运算符和阈值更改回预期值并再次执行。没有结果表明此表达式没有当前警报。 -
请勿假设自定义警报正在工作,除非您已验证该警报在预期时间触发。
-
选择*Alerts* > Rules。
此时将显示警报规则页面。
-
选择*创建自定义规则*。
此时将显示"创建自定义规则"对话框。

-
选中或清除*已启用*复选框,以确定当前是否已启用此警报规则。
如果已禁用警报规则,则不会计算其表达式,也不会触发警报。
-
输入以下信息:
字段 问题描述 唯一名称
此规则的唯一名称。警报规则名称显示在"警报"页面上,也是电子邮件通知的主题。警报规则的名称可以在 1 到 64 个字符之间。
问题描述
对正在发生的问题的描述。说明是警报页面和电子邮件通知中显示的警报消息。警报规则的描述可以介于 1 到 128 个字符之间。
建议操作
(可选)触发此警报时要采取的建议操作。以纯文本形式输入建议操作(无格式代码)。警报规则的建议操作可以介于 0 到 1,024 个字符之间。
-
在条件部分,为一个或多个警报严重性级别输入 Prometheus 表达式。
基本表达式的形式通常为:
[metric] [operator] [value]表达式可以是任意长度,但在用户界面中显示为一行。至少需要一个表达式。
如果节点安装的 RAM 量小于 24,000,000,000 字节(24 GB),则此表达式会触发警报。
node_memory_MemTotal_bytes < 24000000000要查看可用指标和测试 Prometheus 表达式,请选择帮助图标
并点击指向网格管理 API 的"指标"部分的链接。 -
在*持续时间*字段中,输入条件在触发警报之前必须持续有效的时间量,并选择一个时间单位。
要在条件变为真时立即触发警报,请输入 0。增加此值以防止临时条件触发警报。
默认时间间隔为5分钟。
-
选择 Save。
对话框关闭,新的自定义警报规则显示在"警报规则"表中。