Prometheus pull-based metrics collection modeli ile sunucu, container ve uygulama metriklerini toplar. Time-series database (TSDB) olarak local storage kullanır; uzun süreli retention için remote storage (Thanos, Cortex) entegre edilebilir.
node_exporter her sunucuda CPU, memory, disk, network metriklerini expose eder. Prometheus scrape config ile periyodik olarak toplar. Custom application metrics için client library (prometheus/client_golang, prom-client) kullanılır.
Grafana dashboard ve visualization katmanıdır. Prometheus datasource ile query (PromQL) yapılır. Hazır dashboard'lar (Node Exporter Full, PostgreSQL) import edilebilir. Alert panel ve annotation ile incident timeline oluşturulur.
Alertmanager alerting rules (Prometheus alerting rules) tetiklendiğinde notification routing yapar. Slack, PagerDuty, email receiver tanımlanır. inhibition rules ile duplicate alert storm önlenir. severity label ile escalation yapılır.
Production best practices: Prometheus HA (2 replica), recording rules ile query optimization, retention tuning (15-30 gün local), ve blackbox_exporter ile external endpoint monitoring. Grafana SSO (OAuth/LDAP) erişim kontrolü sağlar.
BulutX VPC ve dedicated sunucular monitoring stack kurulumu için yeterli RAM, disk I/O ve private network connectivity sunar. İzleme altyapınız için teklif alın.
İlgili hizmet
Detayları incele