Prometheus
Также: Prometheus monitoring, PromQL, pull-based мониторинг, прометей
Prometheus - система мониторинга с открытым кодом, которая сама опрашивает сервисы по HTTP и собирает метрики - в отличие от push-систем, куда данные отправляют агенты. Разработана в SoundCloud и выпущена в open source в 2015 году, стала стандартом для контейнерных сред и Kubernetes. Для анализа данных используется язык запросов PromQL. Хранилище встроенное, временных рядов, без внешних зависимостей.
Статьи с этим термином · 91
- MinIO self-hosted: строим S3-совместимое хранилище для нескольких клиентов и разбираемся с erasure coding · 6 декабря 2022
- Grafana 9.1: переезжаем на unified alerting и разбираемся с routing tree · 15 сентября 2022
- OpenTelemetry и Jaeger: ищем узкое место там, где метрики молчат · 23 августа 2022
- Proxmox VE 7.x как альтернатива VMware vSphere: первый пилот на 20 ВМ · 22 марта 2022
- Grafana 8.3/8.4 и unified alerting: мигрируем правила, собираем грабли · 8 февраля 2022
- Kubernetes 1.23 и PSP: начинаем миграцию на Pod Security Standards · 14 января 2022
- Kubernetes 1.23: HPA v2 в GA и KEDA для event-driven autoscaling · 22 ноября 2021
- Grafana Tempo в production: S3 вместо Elasticsearch и прощание с Jaeger · 1 ноября 2021
- Grafana 8 + Tempo: разворачиваем distributed tracing и связываем его с метриками и логами · 6 сентября 2021
- Managed Kubernetes в Яндекс.Облаке: первый продакшн-проект, Terraform и CI/CD из GitLab · 25 февраля 2021
- SolarWinds Orion и SUNBURST: инвентаризируем мониторинг после самого громкого взлома 2020-го · 7 января 2021
- Kubernetes 1.20 GA: dockershim deprecated официально, начинаем миграцию · 10 декабря 2020
- OpenTelemetry Collector 0.14: один агент вместо трёх · 26 ноября 2020
- Grafana Loki 2.0: уходим от ELK в пользу лёгкого агрегатора логов для Kubernetes · 16 ноября 2020
- Grafana 7.2: library panels и трансформации без ETL · 19 октября 2020
- Ceph 15 Octopus GA: разворачиваем через cephadm и смотрим на dashboard для OSD latency · 24 сентября 2020
- Kafka 2.6: rolling upgrade с 2.4 и что incremental cooperative rebalancing меняет на практике · 17 августа 2020
- Postgres Operator от Zalando: разворачиваем PostgresCluster вместо ручных реплик · 3 августа 2020
- Prometheus 2.18 в production: снижение памяти и перестройка remote_write под Thanos · 23 июня 2020
- Kubernetes 1.19 и 12-месячный цикл: строим матрицу совместимости до обновления · 9 июня 2020
- Kubernetes 1.18: ловим API deprecation warnings через audit log · 21 апреля 2020
- Ceph 15 Octopus в dev: смотрим на cephadm как замену ansible-ceph для раскатки кластеров · 21 января 2020
- Итоги 2019: Ansible в продакшне, первые Kubernetes-кластеры и КИИ-проекты, которые растянулись на весь год · 7 января 2020
- План на 2020: облако, GitOps на все кластеры и error budget в SLA · 30 декабря 2019
- Loki GA: развернули рядом с Prometheus и убрали Kibana из дежурного арсенала · 9 декабря 2019
- ClickHouse Kafka Engine в продакшне: от событий в топике до аналитики за секунды · 13 ноября 2019
- OpenTelemetry: следим за единым стандартом observability с момента анонса · 11 ноября 2019
- KubeFed v2 beta: пилот с двумя кластерами в разных ЦОД и почему это оказалось сложнее, чем выглядело · 14 октября 2019
- Jaeger в микросервисах: нашли узкое место за час, искали бы неделю · 25 сентября 2019
- Istio 1.2 vs Linkerd 2.5: гоняли оба на одном кластере, смотрели на ресурсы · 11 сентября 2019
- Ceph Nautilus в проде: наконец-то dashboard, который не врёт, и BlueStore без ручной настройки · 19 августа 2019
- Error budget в ретейле: как нарушения SLO за две недели убедили заказчика в canary · 7 августа 2019
- Kafka → ClickHouse с материализованным представлением: заменили двухчасовую SSIS-джобу на потоковый ETL · 24 июля 2019
- SLO на Prometheus: первый error budget и что он нам показал · 15 июля 2019
- Kubernetes 1.15 и зрелые CRD: начинаем оценивать операторы для StatefulSet-приложений · 1 июля 2019
- Zabbix 4.2 и Prometheus exporter: одна консоль для системных метрик и метрик приложений · 6 июня 2019
- OTel Collector как посредник: декаплируем приложения от Jaeger и Prometheus · 20 мая 2019
- KSQL на Kafka: аналитики пишут SQL, Java Streams лежат на полке · 8 мая 2019
- Ceph Nautilus в production: встроенный Dashboard и прирост IOPS на BlueStore без замены железа · 8 апреля 2019
- Cisco Catalyst 9000 и SD-Access: сегментация через SGT работает, лицензии DNA Center - больно · 21 марта 2019
- Grafana Loki 0.1: логи рядом с Prometheus - проще, чем мы ожидали · 18 марта 2019
- Grafana 6.0: обновились, собрали единый dashboard и наконец увидели всю инфраструктуру · 14 марта 2019
- etcd 3.3 и backup-restore: проверили disaster recovery на реальном кластере Kubernetes · 7 марта 2019
- bpftrace на продакшне: ищем задержку в сетевых очередях без остановки сервисов · 14 февраля 2019
- Thanos и remote_write: когда 90 дней метрик Prometheus перестают помещаться · 21 января 2019
- Итоги 2018: Kubernetes в продакшн, Windows Server 2019 и первые реальные аудиты по 187-ФЗ · 17 декабря 2018
- Elastic 6.5: мониторинг кластера и SQL теперь бесплатны - пересматриваем ценность Gold · 28 ноября 2018
- Kubernetes NetworkPolicy с Calico: неделя проектирования, зато east-west трафик под контролем · 5 ноября 2018
- Alertmanager 0.15: многоуровневый routing и silence management - как мы победили alert fatigue · 24 октября 2018
- ClickHouse 1.1.54388: Materialized Views вместо ночных ETL-задач на 500M строк событий безопасности · 19 сентября 2018
- Grafana 5.2: дашборды и datasource в Git - мониторинг как код · 27 августа 2018
- eBPF в продакшне: bcc-tools и bpftrace показали латентность без ребута · 20 августа 2018
- Docker Compose v3, Swarm и Kubernetes: что выбрать для небольшого проекта · 6 августа 2018
- Istio 0.8 LTS: mTLS между микросервисами заработал, Kiali показал кто с кем разговаривает · 16 июля 2018
- Prometheus 2.3: мигрировали с 1.x на 2.x - новая TSDB и WAL меняют картину · 11 июля 2018
- Kubernetes 1.11: мигрируем с kube-dns на CoreDNS и настраиваем split-horizon · 4 июля 2018
- Kubernetes 1.11: IPVS-режим kube-proxy и CoreDNS - что изменилось на практике · 2 июля 2018
- Kubernetes Operators: полугодовой итог - Zalando Postgres Operator в production · 26 июня 2018
- Grafana 5.1 provisioning: дашборды в Git, автозагрузка при деплое · 19 июня 2018
- Prometheus Operator в prod: ServiceMonitor CRD и monitoring-as-code на практике · 12 июня 2018
- Kafka Streams как шина событий: уходим от REST-вызовов между микросервисами · 25 мая 2018
- Envoy Proxy 1.6: разбираем xDS API и sidecar-паттерн для observability без правок в коде · 20 апреля 2018
- Kubernetes Operators: CoreOS объясняет как управлять stateful-приложениями через Custom Resources · 27 марта 2018
- BlueStore в первом продакшн-кластере: +40% throughput и меньше CPU · 20 марта 2018
- Helm 2.8: stable-репозиторий закрывает типовые задачи, но Tiller беспокоит · 6 марта 2018
- Prometheus 2.0: новый TSDB и план миграции с 1.x без боли · 2 февраля 2018
- Приоритеты на 2018: Meltdown/Spectre, акты КИИ и k8s в production · 28 декабря 2017
- ClickHouse 1.1.54310: Materialized Views с фильтрами и ARRAY JOIN для сетевых flow-данных · 27 ноября 2017
- etcd 3.2 в production Kubernetes: Watch API быстрее, алерты - раньше · 9 ноября 2017
- ZFS on Linux 0.7.0 GA: переводим NAS-сервер на свежий релиз и подключаем Prometheus · 31 августа 2017
- Prometheus 2.0 alpha: новый TSDB движок и remote read/write API · 31 июля 2017
- Ceph Luminous GA: переводим тестовый кластер с FileStore на BlueStore · 13 июля 2017
- Prometheus 1.7 в продакшне: тюнинг retention, compaction и federation для нескольких площадок · 22 июня 2017
- Helm 2 и ChartMuseum: управление пакетами Kubernetes в продакшне · 23 мая 2017
- Docker Swarm Mode vs Kubernetes: честное сравнение после года в проде · 20 апреля 2017
- Grafana 4 alerting: когда дашборд умеет звонить, и зачем это нужно рядом с Alertmanager · 13 апреля 2017
- Реестр отечественного ПО в 2017: аудит у клиента с госучастием · 28 марта 2017
- GitLab 9.0: Review Apps и Prometheus из коробки - заканчиваем переезд с Jenkins · 2 марта 2017
- Prometheus 1.5 в продакшне: node-exporter, cAdvisor и первые alert-правила · 14 февраля 2017
- Итоги 2016: контейнеры в пилот, Let's Encrypt переломил TLS, 152-ФЗ стал практикой · 3 января 2017
- Итоги 2016: Windows Server 2016, Mirai и контейнеры взрослеют · 26 декабря 2016
- Apache Spark 2.0 в production: Structured Streaming вместо hourly batch · 14 декабря 2016
- Переходим на Elastic Stack 5.0: X-Pack Security убирает Elasticsearch из DMZ · 16 ноября 2016
- Grafana 3.x + Elasticsearch: метрики и логи в одном дашборде · 21 сентября 2016
- Zabbix 3.0 LTS: мигрируем с 2.4, разбираемся с новым dashboard и меньшей нагрузкой на БД · 24 августа 2016
- Prometheus + Alertmanager: первый опыт рядом с Zabbix · 13 июля 2016
- Итоги H1 2016: TLS стал дешёвым, контейнеры повзрослели, реестр ПО давит · 28 июня 2016
- Prometheus 1.0: переводим production k8s-кластер на pull-мониторинг полностью · 24 июня 2016
- Zabbix на Docker-хостах: почему мы ушли на Prometheus и Grafana · 9 февраля 2016
- Итоги 2015: контейнерная зрелость и регуляторный год · 29 декабря 2015
- Prometheus 0.16: попробовали pull-модель мониторинга для Docker-контейнеров · 24 ноября 2015