Ana içeriğe geç

Aktif alarmları görüntüle

"Şu an bir şey bozuk mu?" sayfası. Canlı güncellenir; daha derin inceleme için Grafana'da açılır.

Nerede​

İki yol:

  • Sidebar → Alarms → Firing sekmesi
  • Doğrudan URL: /alarms/firing

İki yüzey de aynı veriyi gösterir. Standalone URL bookmark / TV dashboard'una pin için faydalı.

Ne görürsünüz​

Aktif organizasyondaki şu an firing durumda olan (state = Alerting) her alarm kuralının listesi:

  • Severity — renkli rozet (kırmızı/turuncu/sarı/gri)
  • Kuralın Adı
  • Started at — bu firing instance'ı ne zaman başladı
  • Latest value — en son evaluation'daki metric değeri + bağlam için threshold
  • Edge instance(s) — eşleşen serinin org'un hangi edge'inden geldiği

Liste 30 saniyede bir polling yapar ve kural durumu değiştiğinde WebSocket ile canlı güncellenir.

Bir satır aç​

Firing satırına tıklamak detail panelini açar:

  • Kuralın değerlendirdiği PromQL (tenant scope zaten uygulanmış — Grafana'nın gerçekten gördüğü)
  • Son 6 saat değerlerinin küçük chart'ı, threshold dashed line olarak çizili
  • Aksiyonlar:
    • Open in Grafana — silence için ya da kurala bağlı panel/dashboard'u incelemek için Grafana'da deep-link
    • Edit — Rules sekmesindeki ile aynı kural edit drawer'ı

Olay sırasında susturma​

Üç seçenek, öneri sırasıyla:

  1. Altta yatan sorunu çözün. Alarm doğruysa doğru cevap gösterdiğini gizlemek değil, gösterdiğini düzeltmektir.
  2. Open in Grafana → Silences → New silence. Zaman bağlı mute için (örn: 2 saatlik migration window). Oturumlar arası ve deploy'lar arası kalır.
  3. DT Edge Platform'da kuralı devre dışı bırak koşulun fire etmeye devam edeceği daha uzun bir mola için. Sidebar → Alarms → Rules sekmesi → satır toggle'ı.

DT Edge Platform'un built-in silence UI'ı yok — Grafana o mekaniği sahiplenir.

"Edge instance(s)" ne demek​

Alarmlar tenant-scoped'tur; backend her PromQL'i Grafana'ya göndermeden önce telemetry_id=~"<organizasyonunuzun-edge'leri>" enjekte eder. Sonuç: sadece organizasyonun edge'lerinden gelen metric serileri eşleşebilir. Firing satırındaki "Edge instance(s)" sütunu o edge'lerin hangi alt kümesinin şu an gerçekten eşleşen data point'leri sağladığını söyler — yani kube_pod_container_status_restarts_total alarmı için pod'ları restart eden "edge-istanbul"un olduğunu görebilirsiniz.

Bir alarm hiç edge listelemeden ateşlenirse PromQL muhtemelen telemetry_id label'ı taşımayan bir vector döndürdü (bazı aggregation'lar onu çıkarır). Alarm hâlâ query seviyesinde tenant-scoped ama UI firing'i belirli bir edge'e atfedemez. Summary metric'lerde yaygın.

X firing iyi de neden burada görmüyorum​

Olası sebepler:

  • Farklı org — org seçicisini değiştirin. Her org sadece kendininkini görür.
  • Farklı cluster'ın Grafana'sı — kurulumunuzda per-edge Grafana var mı? (Hayır — bkz. Açıklama: alarms ve tenant scoping; DT Edge Platform kurulumu başına bir central Grafana var.)
  • Stale tarayıcı — refresh edin. Liste polling yapar ama takılmış WebSocket stale durum gösterebilir.
  • Alert state Alerting değil — Pending (for: window içinde) firing olarak görünmez. Süre dolduğunda flip eder.

Yaygın hatalar​

  • Sayfa boş ama bariz şeyler bozuk — yukardaki "X firing iyi de neden burada görmüyorum"a bakın
  • GRAFANA_NOT_CONFIGURED — admin Admin → Settings'te central Grafana URL/cred'lerini doldurmalı
  • GRAFANA_LIST_FAILED — Grafana erişilemez; admin settings → Test connection'dan durumu kontrol edin

Ayrıca bakın​