series: Мониторинг на Prometheus
- vmsingle: один бинарник VictoriaMetrics вместо всего стека Prometheus Single-node VictoriaMetrics в k0s: встроенный скрейпер со статическими таргетами, RBAC для cAdvisor, hostPath PV и ClusterIP против рестартов CoreDNS.
- Multi-cluster Prometheus: remote_write в центральный VictoriaMetrics Spoke-инстансы Prometheus шлют данные через remote_write в центральный VictoriaMetrics на infra-кластере. externalLabels.cluster, writeRelabelConfigs для снижения трафика, кросс-кластерные дашборды.
- Blackbox exporter и Prometheus Probes для мониторинга эндпоинтов Использование prometheus-blackbox-exporter и Probe CRD для мониторинга HTTP-эндпоинтов, TCP-портов и истечения TLS-сертификатов на кластерах.
- kube-prometheus-stack: полная настройка мониторинга HelmRelease kube-prometheus-stack с настройкой персистентности и retention Prometheus, секрет admin Grafana, ServiceMonitor для кастомных приложений, загрузка дашбордов через sidecar и оценка размера хранилища.
- Провизионирование datasource и дашбордов Grafana через ConfigMap additionalDataSources в values kube-prom-stack, обнаружение дашбордов sidecar'ом из ConfigMap с меткой grafana_dashboard, дашборды в git, структура папок.
- Recording rules Prometheus: предагрегация дорогостоящих запросов PrometheusRule с record:-правилами для CPU/memory/HTTP rate. Соглашение по именованию level:metric:operations. Предрасчёт multi-window burn rate для SLO.
- VictoriaMetrics Operator: VMAgent, VMSingle, VMServiceScrape VMSingle для хранения 6 месяцев, VMAgent как скрейпер только с remote_write, VMServiceScrape как drop-in замена ServiceMonitor, VMRule, настройка datasource Grafana.
- kube-prometheus-stack на multi-cluster: spoke Prometheus, центральный Grafana Grafana на одном кластере, Prometheus на всех шести. Spoke kube-prom-stack с отключённым Grafana, externalLabels.cluster для кросс-кластерных дашбордов.
- Prometheus exporters в Kubernetes: kafka, mongodb, redis и другие Конфиги HelmRelease для kafka-exporter, mongodb-exporter и redis-exporter. Встроенная поддержка Prometheus в RabbitMQ. helm-exporter для отслеживания версий чартов. Паттерны ServiceMonitor для каждого.
- Алерты node-exporter: часы, диски и лимиты inotify PrometheusRule алерты для clock skew, насыщения CPU, давления памяти, предсказания заполнения диска, исчерпания inotify watches и частоты сетевых ошибок — с практическими порогами из продакшена.
- Алертинг Kafka в Kubernetes: от падения брокера до consumer lag PrometheusRule алерты для Kafka: BrokerDown, UnderReplicatedPartitions, OfflinePartitions, lag consumer group, предсказание заполнения диска и JVM memory pressure через метрики kafka-exporter.
- Правильные PrometheusRules: структура, метки и unit-тесты Анатомия PrometheusRule с обязательными метками helm-chart/namespace, аннотации deep-link для Grafana, humanizeTimestamp и humanizeDuration в сообщениях алертов и фреймворк promtool для unit-тестов.
No posts match the selected filters.