トンネルヘルスアラート(旧 Magic Tunnel health alerts)を設定すると、IPsec / GRE トンネルの ヘルスチェック 成功率が、選んだ サービスレベル目標(SLO) を下回ったときに、メール、webhook、PagerDuty の通知を受け取れます。
トンネルヘルスアラートは、アラート対象の各 IPsec / GRE トンネルについて、過去 6 時間に顧客トラフィック(ヘルスチェックトラフィックは除く)を実際に転送したトンネルのヘルスチェック成功率を監視します。トンネルごとに、ヘルスチェックが成功しなければならない割合の SLO しきい値を定義できます。対象トンネルの成功数が SLO しきい値を下回ると、アラートが発火します。
トンネルヘルスアラートが発火すると、メール、webhook、PagerDuty の通知に次のデータが届きます。
- Cloudflare アカウント名
- Cloudflare アカウント ID
- アラート種別
- トンネル名
- トンネル ID
- トンネル状態
- アラート SLO
- タイムスタンプ
現在、Cloudflare ダッシュボードから設定できる SLO しきい値は 7 つです。より細かく設定するには、API を使います。
トンネルヘルスアラートの SLO しきい値は、アラート対象の各 IPsec / GRE トンネルにおけるヘルスチェック成功率です。
| Alert Sensitivity Level | SLO threshold |
|---|---|
| Minimum | 95.0 |
| Very low | 96.0 |
| Low | 97.0 |
| Medium | 98.0 |
| High | 99.0 |
| Very high | 99.5 |
| Maximum | 99.9 |
アラートを受け取るまでの時間は、SLO しきい値に設定した感度によって変わります。感度を高くすると、トンネル健全性の低下をより早く知らせますが、短時間や軽微な乱れでもアラートが出ることがあります。感度を低くすると誤報は減りますが、深刻度の低い問題の通知が遅れることがあります。
検出のタイミング自体は感度によらず同じです。通知の速さは、トンネル健全性の低下幅と選んだ感度に依存します。用途に合う値を決めるには、SLO をテストする ことを Cloudflare は推奨します。
詳細は トンネルヘルスアラートの算出方法 を参照してください。
-
Notifications ページを開きます。
Notifications を開く ↗ -
Add を選びます。
-
Product のドロップダウンから Cloudflare WAN を選びます。
-
Tunnel Health Check Alert > Select を選び、通知を追加します。トンネル単位、またはデータセンター単位(ベータ)でアラートを追加できます。
Alert by tunnel
- Alert by tunnel を選びます。
- 通知の名前と説明を入力します。
- 通知を受け取る人の webhook またはメールアドレスを追加し、Next を選びます。
- ドロップダウンから Alert Sensitivity Level のしきい値を選びます。デフォルトは Medium (98.0) です。Minimum (95.0) から Maximum (99.9) まで選べます。詳細は トンネルヘルスアラートの算出方法 を参照してください。
- Alert interval のドロップダウンで、Cloudflare が重複アラートを送るまでに必要な最短間隔を設定します。5 分から 7 日まで選べます。
- 選んだアラート感度を、今後作成するすべての新しいトンネルに自動適用する場合は、Set as default alert for any new tunnels created in the future を有効にします。
- Next を選びます。
- アラートを受け取るトンネルを選びます。トンネル名で検索するか、種別(Generic Routing Encapsulation(GRE)、Internet Protocol Security(IPsec)、CNI(Cloudflare Network Interconnect))で絞り込めます。Next を選びます。
- アラートの内容を確認します。正しければ Create alert を選びます。
Alert by data center (beta)
- Alert by data center を選びます。
- 通知の名前と説明を入力します。
- 通知を受け取る人の webhook またはメールアドレスを追加し、Next を選びます。
- ドロップダウンから Alert Sensitivity Level のしきい値を選びます。デフォルトは Medium (98.0) です。Minimum (95.0) から Maximum (99.9) まで選べます。詳細は トンネルヘルスアラートの算出方法 を参照してください。
- Alert interval のドロップダウンで、Cloudflare が重複アラートを送るまでに必要な最短間隔を設定します。5 分から 7 日まで選べます。
- アラートを受け取るデータセンターを選び、Next を選びます。
- アラートを受け取るトンネルを選びます。トンネル名で検索するか、種別(GRE、IPsec、CNI(Cloudflare Network Interconnect))で絞り込めます。Next を選びます。
- アラートの内容を確認します。正しければ Create alert を選びます。
トンネルヘルスアラートを作成する POST リクエスト を送ります。SLO 値は 0 から 99.99 のあいだで設定できます。
Required API token permissions
At least one of the following token permissions is required:Notifications WriteAccount Settings Write
curl "https://api.cloudflare.com/client/v4/accounts/$ACCOUNT_ID/alerting/v3/policies" \
--request POST \
--header "Authorization: Bearer $CLOUDFLARE_API_TOKEN" \
--json '{
"alert_type": "magic_wan_tunnel_health",
"description": "<DESCRIBE_POLICY>",
"enabled": true,
"filters": {
"slo": [
"99.9"
]
},
"mechanisms": {
"email": [
{
"id": "EMAIL_ADDRESS"
}
]
},
"name": "<DESCRIBE_ALERT>"
}'
{
"result": [
{
"id": "f174e90a-fafe-4643-bbbc-4a0ed4fc8415",
"name": "<POLICY_NAME>",
"description": "<POLICY_DESCRIPTION>",
"enabled": true,
"alert_type": "magic_wan_tunnel_health",
"mechanisms": {
"email": [
{
"id": "<YOUR_EMAIL>"
}
]
},
"created": "2024-09-11T14:13:29.585658Z",
"modified": "2024-09-11T14:13:29.585658Z",
"conditions": {
"and": [
{
"or": [
{
"<=": [
{
"var": "slo"
},
"99.9"
]
}
]
}
]
},
"filters": {
"slo": ["99.9"]
}
}
],
"success": true,
"errors": [],
"messages": []
}
特定のアラート感度が用途に合うかをテストするには、次の手順を行います。
- 過去 6 時間にトラフィックがあるトンネルに対し、特定の感度で アラートを作成します。どのトンネルを選ぶか不明な場合は、ネットワークのリアルタイムおよび過去データを Network Analytics で確認します。
- テスト対象のトンネルを無効にし、ヘルスチェック が 100% 失敗する状態にします。
- Cloudflare がアラートを送るまでの時間は、選んだ感度によって変わります。