tag: prometheus
- Multi-cluster Prometheus: remote_write в центральный VictoriaMetrics Spoke-инстансы Prometheus шлют данные через remote_write в центральный VictoriaMetrics на infra-кластере. externalLabels.cluster, writeRelabelConfigs для снижения трафика, кросс-кластерные дашборды.
- Blackbox exporter и Prometheus Probes для мониторинга эндпоинтов Использование prometheus-blackbox-exporter и Probe CRD для мониторинга HTTP-эндпоинтов, TCP-портов и истечения TLS-сертификатов на кластерах.
- Маршрутизация Alertmanager: уведомления в Telegram с правилами ингибиции Дерево маршрутов Alertmanager с маршрутизацией по severity, Telegram bot receiver, правила ингибиции для подавления каскадных алертов, конфигурация группировки, Silence API и amtool для тестирования решений.
- kube-prometheus-stack: полная настройка мониторинга HelmRelease kube-prometheus-stack с настройкой персистентности и retention Prometheus, секрет admin Grafana, ServiceMonitor для кастомных приложений, загрузка дашбордов через sidecar и оценка размера хранилища.
- Recording rules Prometheus: предагрегация дорогостоящих запросов PrometheusRule с record:-правилами для CPU/memory/HTTP rate. Соглашение по именованию level:metric:operations. Предрасчёт multi-window burn rate для SLO.
- kube-prometheus-stack на multi-cluster: spoke Prometheus, центральный Grafana Grafana на одном кластере, Prometheus на всех шести. Spoke kube-prom-stack с отключённым Grafana, externalLabels.cluster для кросс-кластерных дашбордов.
- Prometheus exporters в Kubernetes: kafka, mongodb, redis и другие Конфиги HelmRelease для kafka-exporter, mongodb-exporter и redis-exporter. Встроенная поддержка Prometheus в RabbitMQ. helm-exporter для отслеживания версий чартов. Паттерны ServiceMonitor для каждого.
- Алерты node-exporter: часы, диски и лимиты inotify PrometheusRule алерты для clock skew, насыщения CPU, давления памяти, предсказания заполнения диска, исчерпания inotify watches и частоты сетевых ошибок — с практическими порогами из продакшена.
- Алертинг Kafka в Kubernetes: от падения брокера до consumer lag PrometheusRule алерты для Kafka: BrokerDown, UnderReplicatedPartitions, OfflinePartitions, lag consumer group, предсказание заполнения диска и JVM memory pressure через метрики kafka-exporter.
- Правильные PrometheusRules: структура, метки и unit-тесты Анатомия PrometheusRule с обязательными метками helm-chart/namespace, аннотации deep-link для Grafana, humanizeTimestamp и humanizeDuration в сообщениях алертов и фреймворк promtool для unit-тестов.
No posts match the selected filters.