トンネルヘルスアラート(旧 Magic Tunnel ヘルスアラート)を設定すると、IPsec/GRE トンネルの成功した ヘルスチェック の割合が、選択した サービスレベル目標(SLO) を下回ったときに、メール、Webhook、PagerDuty で通知を受け取れます。
トンネルヘルスアラートは、アラートに含めた各 IPsec/GRE トンネルについて、過去 6 時間に顧客トラフィック(ヘルスチェックトラフィックを除く)を実際に転送したトンネルのヘルスチェック成功率を監視します。トンネルごとに、ヘルスチェックが成功しなければならない割合の SLO しきい値を定義できます。アラートに含めた IPsec/GRE トンネルの成功ヘルスチェック数が SLO しきい値を下回ると、アラートが発火します。
トンネルヘルスアラートが発火すると、メール、Webhook、PagerDuty の通知に次のデータが含まれます。
- Cloudflare アカウント名
- Cloudflare アカウント ID
- アラートの種類
- トンネル名
- トンネル ID
- トンネルの状態
- アラート SLO
- タイムスタンプ
現在、Cloudflare ダッシュボードでは 7 つの SLO しきい値を設定できます。より細かく設定するには、API を使います。
トンネルヘルスアラートの SLO しきい値は、アラートに含めた各 IPsec/GRE トンネルの成功ヘルスチェックの割合です。
| アラート感度レベル | SLO しきい値 |
|---|---|
| 最小 | 95.0 |
| 非常に低い | 96.0 |
| 低い | 97.0 |
| 中 | 98.0 |
| 高い | 99.0 |
| 非常に高い | 99.5 |
| 最大 | 99.9 |
アラートを受け取るまでの時間は、SLO しきい値に設定した感度レベルによって変わります。感度を高くすると、トンネルの健全性が低下したときに早く通知されますが、短時間または軽微な障害でもアラートが出ることがあります。感度を低くすると誤検知は減りますが、深刻度の低い問題の通知が遅れることがあります。
検出のタイミング自体は感度レベルによらず同じです。通知の速さは、トンネルの健全性がどれだけ低下したかと、選んだ感度に依存します。ユースケースに合う値を決めるため、SLO をテスト することをおすすめします。
詳細は Cloudflare がトンネルヘルスアラートを計算する方法 を参照してください。
-
Notifications ページを開きます。
Notifications を開く ↗ -
Add を選択します。
-
Product のドロップダウンメニューから Cloudflare WAN を選びます。
-
Tunnel Health Check Alert > Select を選択して通知を追加します。トンネル単位またはデータセンター単位(ベータ)でアラートを追加できます。
トンネル単位のアラート
- Alert by tunnel を選択します。
- 通知の名前と説明を入力します。
- 通知を受け取る人の Webhook またはメールアドレスを追加し、Next を選択します。
- ドロップダウンメニューから Alert Sensitivity Level のしきい値を選びます。デフォルトは Medium (98.0) です。Minimum (95.0) から Maximum (99.9) まで選べます。詳細は Cloudflare がトンネルヘルスアラートを計算する方法 を参照してください。
- Alert interval のドロップダウンメニューで、Cloudflare が重複アラートを送るまでに空ける最短時間を設定します。5 分から 7 日まで選べます。
- 選んだアラート感度レベルを、今後作成するすべての新しいトンネルに自動適用する場合は、Set as default alert for any new tunnels created in the future を有効にします。
- Next を選択します。
- アラートを受け取るトンネルを選びます。トンネル名で検索するか、種類(Generic Routing Encapsulation(GRE)、Internet Protocol Security(IPsec)、CNI(Cloudflare Network Interconnect))で絞り込めます。Next を選択します。
- アラートの内容を確認します。正しければ Create alert を選択します。
データセンター単位のアラート(ベータ)
- Alert by data center を選択します。
- 通知の名前と説明を入力します。
- 通知を受け取る人の Webhook またはメールアドレスを追加し、Next を選択します。
- ドロップダウンメニューから Alert Sensitivity Level のしきい値を選びます。デフォルトは Medium (98.0) です。Minimum (95.0) から Maximum (99.9) まで選べます。詳細は Cloudflare がトンネルヘルスアラートを計算する方法 を参照してください。
- Alert interval のドロップダウンメニューで、Cloudflare が重複アラートを送るまでに空ける最短時間を設定します。5 分から 7 日まで選べます。
- アラートを受け取るデータセンターを選び、Next を選択します。
- アラートを受け取るトンネルを選びます。トンネル名で検索するか、種類(GRE、IPsec、CNI(Cloudflare Network Interconnect))で絞り込めます。Next を選択します。
- アラートの内容を確認します。正しければ Create alert を選択します。
トンネルヘルスアラートを作成する POST リクエスト を送ります。SLO 値は 0 から 99.99 の範囲で設定できます。
Required API token permissions
At least one of the following token permissions is required:Notifications WriteAccount Settings Write
curl "https://api.cloudflare.com/client/v4/accounts/$ACCOUNT_ID/alerting/v3/policies" \
--request POST \
--header "Authorization: Bearer $CLOUDFLARE_API_TOKEN" \
--json '{
"alert_type": "magic_wan_tunnel_health",
"description": "<DESCRIBE_POLICY>",
"enabled": true,
"filters": {
"slo": [
"99.9"
]
},
"mechanisms": {
"email": [
{
"id": "EMAIL_ADDRESS"
}
]
},
"name": "<DESCRIBE_ALERT>"
}'
{
"result": [
{
"id": "f174e90a-fafe-4643-bbbc-4a0ed4fc8415",
"name": "<POLICY_NAME>",
"description": "<POLICY_DESCRIPTION>",
"enabled": true,
"alert_type": "magic_wan_tunnel_health",
"mechanisms": {
"email": [
{
"id": "<YOUR_EMAIL>"
}
]
},
"created": "2024-09-11T14:13:29.585658Z",
"modified": "2024-09-11T14:13:29.585658Z",
"conditions": {
"and": [
{
"or": [
{
"<=": [
{
"var": "slo"
},
"99.9"
]
}
]
}
]
},
"filters": {
"slo": ["99.9"]
}
}
],
"success": true,
"errors": [],
"messages": []
}
特定のアラート感度レベルがユースケースに合うかテストする手順は次のとおりです。
- 過去 6 時間にトラフィックがあるトンネルに対して、特定の感度レベルの アラートを作成 します。どのトンネルを選ぶか迷う場合は、Network Analytics でネットワークのリアルタイムおよび過去のデータを確認してください。
- テスト対象のトンネルを無効にし、ヘルスチェック失敗 が 100% になるようにします。
- Cloudflare がアラートを送るまでの時間は、選んだ感度によって変わります。