Aktif alarmları görüntüle
"Şu an bir şey bozuk mu?" sayfası. Canlı güncellenir; daha derin inceleme için Grafana'da açılır.
Nerede
İki yol:
- Sidebar → Alarms → Firing sekmesi
- Doğrudan URL:
/alarms/firing
İki yüzey de aynı veriyi gösterir. Standalone URL bookmark / TV dashboard'una pin için faydalı.
Ne görürsünüz
Aktif organizasyondaki şu an firing durumda olan (state =
Alerting) her alarm kuralının listesi:
- Severity — renkli rozet (kırmızı/turuncu/sarı/gri)
- Kuralın Adı
- Started at — bu firing instance'ı ne zaman başladı
- Latest value — en son evaluation'daki metric değeri + bağlam için threshold
- Edge instance(s) — eşleşen serinin org'un hangi edge'inden geldiği
Liste 30 saniyede bir polling yapar ve kural durumu değiştiğinde WebSocket ile canlı güncellenir.
Bir satır aç
Firing satırına tıklamak detail panelini açar:
- Kuralın değerlendirdiği PromQL (tenant scope zaten uygulanmış — Grafana'nın gerçekten gördüğü)
- Son 6 saat değerlerinin küçük chart'ı, threshold dashed line olarak çizili
- Aksiyonlar:
- Open in Grafana — silence için ya da kurala bağlı panel/dashboard'u incelemek için Grafana'da deep-link
- Edit — Rules sekmesindeki ile aynı kural edit drawer'ı
Olay sırasında susturma
Üç seçenek, öneri sırasıyla:
- Altta yatan sorunu çözün. Alarm doğruysa doğru cevap gösterdiğini gizlemek değil, gösterdiğini düzeltmektir.
- Open in Grafana → Silences → New silence. Zaman bağlı mute için (örn: 2 saatlik migration window). Oturumlar arası ve deploy'lar arası kalır.
- DT Edge Platform'da kuralı devre dışı bırak koşulun fire etmeye devam edeceği daha uzun bir mola için. Sidebar → Alarms → Rules sekmesi → satır toggle'ı.
DT Edge Platform'un built-in silence UI'ı yok — Grafana o mekaniği sahiplenir.
"Edge instance(s)" ne demek
Alarmlar tenant-scoped'tur; backend her PromQL'i Grafana'ya
göndermeden önce
telemetry_id=~"<organizasyonunuzun-edge'leri>" enjekte eder.
Sonuç: sadece organizasyonun edge'lerinden gelen metric
serileri eşleşebilir. Firing satırındaki "Edge instance(s)"
sütunu o edge'lerin hangi alt kümesinin şu an gerçekten eşleşen
data point'leri sağladığını söyler — yani
kube_pod_container_status_restarts_total alarmı için pod'ları
restart eden "edge-istanbul"un olduğunu görebilirsiniz.
Bir alarm hiç edge listelemeden ateşlenirse PromQL muhtemelen
telemetry_id label'ı taşımayan bir vector döndürdü (bazı
aggregation'lar onu çıkarır). Alarm hâlâ query seviyesinde
tenant-scoped ama UI firing'i belirli bir edge'e atfedemez.
Summary metric'lerde yaygın.
X firing iyi de neden burada görmüyorum
Olası sebepler:
- Farklı org — org seçicisini değiştirin. Her org sadece kendininkini görür.
- Farklı cluster'ın Grafana'sı — kurulumunuzda per-edge Grafana var mı? (Hayır — bkz. Açıklama: alarms ve tenant scoping; DT Edge Platform kurulumu başına bir central Grafana var.)
- Stale tarayıcı — refresh edin. Liste polling yapar ama takılmış WebSocket stale durum gösterebilir.
- Alert state
Alertingdeğil —Pending(for:window içinde) firing olarak görünmez. Süre dolduğunda flip eder.
Yaygın hatalar
- Sayfa boş ama bariz şeyler bozuk — yukardaki "X firing iyi de neden burada görmüyorum"a bakın
GRAFANA_NOT_CONFIGURED— admin Admin → Settings'te central Grafana URL/cred'lerini doldurmalıGRAFANA_LIST_FAILED— Grafana erişilemez; admin settings → Test connection'dan durumu kontrol edin