Grafana i Prometheus
Grafana i Prometheus to powszechny duet open-source: Prometheus okresowo scrapuje endpointy metryk i przechowuje szeregi czasowe; Grafana wizualizuje je w dashboardach i obsługuje alerty (np. przez Alertmanager). Model pull i język zapytań PromQL pozwalają agregować wykorzystanie CPU, latency HTTP, kolejki i custom business metrics.
Przy szczytach ruchu reklamowego zespoły operacyjne monitorują saturację instancji, błędy 5xx i głębokość kolejek — to bezpośrednio wpływa na konwersję i postrzeganie marki. Wspólne dashboardy dla dev i marketingu (np. KPI techniczne kampanii) poprawiają komunikację podczas live eventów. Eksport metryk z Kubernetes i service mesh jest dobrze wspierany.
Definiuj alerty na symptomach dla użytkownika (SLI/SLO), nie tylko na surowych CPU. Retencja i koszt dysku rosną z cardinality — planuj downsampling lub remote storage dla długich horyzontów.