ApsaraDB for ClickHouse では、クラスターの主要なメトリクスに対するアラートを設定できます。メトリクスの値が設定したしきい値から外れた場合、システムはアラートグループ内の連絡先にアラート通知を送信し、問題の迅速な特定に役立ちます。このトピックでは、ApsaraDB for ClickHouse クラスターのアラートルールを設定する方法について説明します。
前提条件
-
クラスターが Community Edition または Enterprise Edition のクラスターであること。
-
ApsaraDB for ClickHouse のアラート機能は Application Real-Time Monitoring Service (ARMS) に依存します。RAM ユーザーの場合は、ARMS を管理するために AliyunARMSFullAccess 権限が必要です。この権限を付与する方法の詳細については、「RAM ユーザーの権限を管理する」をご参照ください。
使用上の注意
CloudMonitor コンソールでは、Enterprise Edition クラスターのモニタリング情報を表示できません。
手順
ApsaraDB for ClickHouse コンソール
クラスターが以下の両方の条件を満たす場合は、「旧コンソールの手順」をご参照ください。
-
クラスターが 2021 年 12 月 1 日より前に作成されている。
-
クラスターが中国 (青島) または中国 (フフホト) リージョンにあります。
-
ApsaraDB for ClickHouse コンソールにログインします。
-
ページの左上で、対象クラスターがあるリージョンを選択します。
-
クラスターリスト ページで、Community Edition インスタンスのリスト または Enterprise Edition インスタンスのリスト を選択し、対象のクラスターの ID をクリックします。
-
左側のナビゲーションペインで、モニタリングアラーム をクリックします。
-
監視情報 ページで、クラスターアラーム タブをクリックします。
-
クラスターのアラートルールを作成するボタンをクリックします。
説明コミュニティ版クラスターの場合、ボタンは[ClickHouse アラートルールの作成]です。
エンタープライズ版クラスターの場合、ボタンは [エンタープライズ版 ClickHouse アラートルールの作成] です。
-
[ClickHouse アラートルールの作成] または [エンタープライズ版 ClickHouse アラートルールの作成] ページで、次のパラメーターを設定します。
説明ApsaraDB for ClickHouse は、アラートルール用に 2 つのチェックタイプを提供しています。静的しきい値とカスタム PromQL です。パラメータは選択したチェックタイプによって異なります。
-
静的しきい値 チェックタイプでは、事前定義されたメトリクスから選択することで、アラートルールを迅速に作成できます。
-
カスタム PromQL チェックタイプは、システムで事前定義されていないメトリクスに対してアラートルールを作成する場合に使用します。
静的しきい値
パラメータ
説明
例
[アラート名]
アラートルールの名前。
CPU 使用率 アラート
[Check Type]
[静的しきい値] を選択します。
静的しきい値
[クラスター]
アラートルールの対象クラスター。
cc-bp1lxbo89u95****
[アラートグループ]
アラートグループを選択します。
使用可能なアラートグループは、Prometheus インスタンスタイプによって異なります。
ClickHouse オープンソースエディション
[アラートメトリック]
モニタリングするメトリクス。使用可能なメトリクスは、選択した [アラートグループ] によって異なります。
CPU 使用率
[アラート条件]
選択したメトリクスのトリガー条件を設定します。
CPU 使用率が
80% より大きい場合にアラートがトリガーされます。[フィルタリング条件]
フィルターなし
なし
[データプレビュー]
データプレビュー セクションには、アラート条件に対応する PromQL ステートメントが表示され、現在のアラート ルールに設定されているモニタリング メトリックの値が時系列曲線としてプロットされます。
-
デフォルトでは、1 つのリソースのリアルタイム値のみが表示されます。
-
対象リソースと時間範囲を選択して、異なるリソースの異なる期間の値を表示できます。
説明-
アラートしきい値は、グラフ内に赤い水平線として表示されます。しきい値を満たす時系列データは濃い赤色で、しきい値を満たさないデータは青色で表示されます。
-
時系列グラフにカーソルを合わせると、特定の時点のリソース詳細が表示されます。
-
時系列グラフで時間範囲を選択すると、指定した期間の時系列が表示されます。
なし
[期間]
-
条件が満たされると即座にアラートがトリガーされます。つまり、データポイントが 1 つでもしきい値に達するとアラートがトリガーされます。
-
条件が N 分間継続した場合にのみアラートがトリガーされます。
1
[アラートレベル]
アラートの重要度レベル。デフォルトレベルはデフォルトです。重要度レベルは、低い順にデフォルト、P4、P3、P2、P1 です。
P2
[アラートの内容]
アラート通知の内容。Go テンプレート構文を使用して変数を含めることができます。
ノード: {{$labels.pod_name}} CPU 使用率 {{$labels.metrics_params_opt_label_value}} {{$labels.metrics_params_value}}%、現在の値 {{ printf "%.2f" $value }}%
[アラート通知]
[シンプルモード]
[操作対象]: アラートがトリガーされた際の通知先。
[通知期間]: アラート通知が送信される期間。この期間外にトリガーされたアラートは無視されます。
[再送信ポリシー]: アラートがトリガーされたときに繰り返し通知を送信するポリシー。
-
[操作対象]: 連絡先を選択し、通知方法 ([メール]、[電話]、[SMS]、または [グループ @]) を指定します。[+ 通知オブジェクトの作成] をクリックして、新しい連絡先を追加します。
-
[通知期間]: 開始時刻と終了時刻を設定します (例: 00:00~23:59)。24 時間以内の日をまたぐ設定もサポートされています。
-
[繰り返しポリシー]: [エスカレーションポリシーは不要。アラートが回復しない場合に 1 回だけ送信します] を選択するか、[アラートが回復しない場合、指定された間隔で繰り返し通知を送信します] を選択します。
[通常モード]
[通知ポリシーのクイック指定] でポリシーを指定します。
重要[通知ポリシーをクイック指定] オプションにより、現在のアラートルールからのイベントは、選択した通知ポリシーによって照合されます。ただし、これらのイベントは、あいまい一致を使用する他の通知ポリシーによっても照合される可能性があります。アラートルールのイベントと通知ポリシーの関係は多対多です。
-
通知ルールを指定しません。
-
既存の通知ポリシーを選択します。
説明[通知ポリシーの作成] をクリックすると、通知ポリシーを作成できます。詳細については、「通知ポリシー」をご参照ください。
通知ポリシーを指定しない
[詳細設定]
[アラートチェック期間]
アラート条件をチェックする頻度。最小値およびデフォルト値は 1 分です。
1 分
[データ完全性チェック]
データが収集、送信、保存されるまで待機してからアラートチェックを実行します。デフォルト値は「はい」です。ほとんどの場合、この値を変更する必要はありません。
はい
[タグ]
アラートルールにタグを設定します。タグは、通知ポリシーの一致条件として使用できます。
なし
[Comment]
アラートルールにコメントを追加します。
なし
カスタム PromQL
パラメータ
説明
例
[アラート名]
アラートルールの名前。
Pod CPU 使用率が 8% より大きい
[Check Type]
[カスタム PromQL] に設定します。
カスタム PromQL
[クラスター]
アラートルールの対象クラスター。
cc-bp1lxbo89u95****
[アラートグループを参照]
アラートグループを選択します。
使用可能なアラートグループは、Prometheus インスタンスタイプによって異なります。
ClickHouse オープンソースエディション
[アラートメトリックを参照]
オプション。一般的なメトリクスの PromQL テンプレートが提供されています。テンプレートを選択してから変更できます。
使用可能な参照メトリクスオプションは、選択した Prometheus インスタンスタイプに基づいて自動的に絞り込まれます。
HTTP 接続数
[カスタム PromQL ステートメント]
アラート条件を定義する PromQL ステートメント。
clickhouse_http_conn_usage_count{} > 1000[データプレビュー]
[期間]
-
条件が満たされると即座にアラートがトリガーされます。つまり、データポイントが 1 つでもしきい値に達するとアラートがトリガーされます。
-
条件が N 分間継続した場合にのみアラートがトリガーされます。
1
[アラートレベル]
アラートの重大度レベル。デフォルトレベルはデフォルトです。重大度レベルは、低い順に Default、P4、P3、P2、P1 です。
デフォルト
[アラートの内容]
アラート通知の内容。Go テンプレート構文を使用して変数を含めることができます。
名前空間: {{$labels.namespace}}/Pod: {{$labels.pod_name}}/ディスクデバイス: {{$labels.device}} 使用率が 90% を超えています、現在の値 {{ printf "%.2f" $value }}%
[アラート通知]
[シンプルモード]
[操作対象]: アラートがトリガーされた際の通知先。
[通知期間]: アラート通知が送信される期間。この期間外にトリガーされたアラートは無視されます。
[繰り返しポリシー]: アラートがトリガーされたときに繰り返し通知を送信するポリシー。
[通常モード]
[通知ポリシーのクイック指定] を使用してポリシーを指定します。
重要[通知ポリシーをクイック指定] オプションを使用すると、現在のアラートルールからのイベントは、選択した通知ポリシーと確実に一致します。ただし、これらのイベントは、あいまい一致を使用する他の通知ポリシーとも一致する可能性があります。アラートルールイベントと通知ポリシーの関係は多対多です。
-
通知ルールを指定しません。
-
既存の通知ポリシーを選択します。
説明[通知ポリシーの作成] をクリックして、通知ポリシーを作成できます。詳細については、「通知ポリシー」をご参照ください。
通知ポリシーを指定しない
[詳細設定]
[アラートチェック期間]
アラート条件をチェックする頻度。最小値およびデフォルト値は 1 分です。
1 分
[データが揃った時にもう一度確認する]
データが収集、送信、保存されるまで待機してからアラートチェックを実行します。デフォルト値は「はい」です。ほとんどの場合、この値を変更する必要はありません。
はい
[タグ]
アラートルールにタグを設定します。タグは、通知ポリシーの一致条件として使用できます。
なし
[Comment]
アラートルールにコメントを追加します。
なし
-
-
パラメーターを設定した後、終了 をクリックします。
CloudMonitor コンソール
-
CloudMonitor コンソール にログインします。
-
左側のナビゲーションペインで、 を選択します。
-
アラートルール ページで、アラームルールを作成 をクリックします。
-
アラームルールを作成 パネルで、次のパラメーターを設定します。
パラメーター
説明
[製品]
ApsaraDB for ClickHouse のクラスタータイプを選択します。 有効値:
-
ApsaraDB for ClickHouse:2021 年 12 月 1 日より前に購入した Community Edition クラスター。
-
ApsaraDB for ClickHouse Community Edition:2021 年 12 月 1 日以降に購入した Community Edition クラスター。
[リソース範囲]
アラートルールを適用するリソースの範囲です。 有効値:
-
すべてのリソース:アラートルールは、指定されたクラウドサービスのすべてのリソース (新しく追加されたリソースを含む) に適用されます。
-
アプリケーショングループ:アラートルールは、指定されたクラウドサービスのアプリケーション グループ内のすべてのリソース (新しく追加されたリソースを含む) に適用されます。
-
インスタンス:アラートルールは、クラウドサービスの特定のリソースに適用されます。
[説明]
アラートのトリガー条件を定義します。 ルールの説明を設定するには、次の手順に従います。
-
ルールの追加 をクリックします。
-
[ルール説明の設定] パネルで、 ルール名 を入力し、ルール条件を設定します。
-
単一メトリック:メトリックを選択し、そのしきい値とアラートレベルを設定します。
-
複数メトリクス:アラートレベルを選択し、2 つ以上のメトリックのアラート条件を設定します。
-
インテリジェントしきい値:インテリジェントしきい値の詳細については、「概要」および「インテリジェントしきい値のアラートルールを作成する」をご参照ください。
説明インテリジェントしきい値機能はベータテスト中です。 アクセスを申請するには、チケットを送信する必要があります。
-
-
を決定 をクリックします。
説明複雑なアラート条件の設定方法については、「アラートルールの式」をご参照ください。
[サイレントチャネルの時刻]
CloudMonitor が未解決のアラートを再度通知するまでの間隔です。 有効値:5 分、15 分、30 分、60 分、3 時間、6 時間、12 時間、24 時間。
監視対象のメトリックがしきい値に達すると、アラートが送信されます。 メトリックがミュート期間中にしきい値を超え続けても、新しいアラートは送信されません。 ミュート期間後もメトリックがアラート状態にある場合、CloudMonitor は別のアラート通知を送信します。
たとえば、サイレントチャネルの時刻 を 12 時間 に設定した場合、アラートが解決されないと、CloudMonitor は 12 時間後に通知を再送信します。
[発効時間]
アラートルールが有効な期間です。 この期間中にトリガーされたアラートに対してのみ通知が送信されます。
説明有効期間外にアラートがトリガーされた場合、通知は送信されませんが、アラートは [アラート履歴] リストに記録されます。
[アラート連絡先グループ]
アラート通知の送信先となる連絡先グループです。
アプリケーション グループのアラート通知は、指定された連絡先グループ内の連絡先に送信されます。 連絡先グループには、1 人以上の連絡先を含めることができます。
連絡先と連絡先グループの作成方法の詳細については、「アラート連絡先または連絡先グループの作成」をご参照ください。
[タグ]
アラートルールのタグです。タグキーとタグ値で構成されます。
説明最大 6 個のタグを追加できます。
[詳細設定]
[アラームコールバック]
CloudMonitor から POST リクエストを介してアラート情報を受信する、一般公開されている URL です。 HTTP プロトコルのみがサポートされています。 アラートコールバックの設定方法の詳細については、「Webhook を使用してしきい値トリガーのアラートを送信する」をご参照ください。
アラートコールバック URL の接続性をテストするには、次の手順を実行します。
-
コールバック URL の横にある テスト をクリックします。
WebHook テスト パネルで、Webhook のステータスコードとテスト結果の詳細を確認して、接続の問題を診断できます。
説明Webhook の [コールバックテンプレートタイプ] と [言語] を設定し、再度 テスト をクリックして対応するテスト結果を表示することもできます。
-
Disable をクリックします。
[Auto Scaling]
Auto Scaling を有効にすると、アラート発生時に対応するスケーリングルールがトリガーされます。 Auto Scaling の 地域:、スケーリンググループ、スケーリングルール を設定する必要があります。
-
スケーリンググループの作成方法の詳細については、「スケーリンググループの管理」をご参照ください。
-
スケーリングルールの作成方法の詳細については、「スケーリングルールの管理」をご参照ください。
[Log Service]
Log Service を有効にすると、アラート発生時にアラート情報が Log Service の Logstore に送信されます。 Log Service の 地域:、[ProjectName]、[Logstore] を設定する必要があります。
Project と Logstore の作成方法の詳細については、「iLogtail を使用して ECS インスタンスからテキストログを収集および分析する」をご参照ください。
[Simple Massage Queue (旧 MNS)(SMQ) - トピック]
[Message Service MNS-Topic] を有効にすると、アラート発生時にアラート情報が Simple Message Queue (MNS) のトピックに送信されます。
この機能を有効にするには、Simple Message Queue (MNS) のリージョンとトピックを設定する必要があります。 トピックの作成方法の詳細については、「トピックの作成」をご参照ください。
[Function Compute]
Function Compute を有効にすると、アラート発生時にアラート通知がフォーマットのために Function Compute に送信されます。 Function Compute のリージョン、サービス、関数を設定する必要があります。
サービスと関数の作成方法の詳細については、「関数の作成」をご参照ください。
[データ処理方法なし]
監視データが利用できない場合にアラートを処理する方法です。 有効値:
-
何もしないでください (デフォルト)
-
データアラームを送信しない
-
回復済みとして処理
-
(オプション) 古いコンソール
次のステップ
ApsaraDB for ClickHouse コンソールで作成したアラートルールを管理するには、「アラートルールの管理」をご参照ください。
関連ドキュメント
CloudMonitor を初めてご利用の場合は、「CloudMonitor とは」をご参照ください。