Prometheus
Также: Prometheus monitoring, PromQL, pull-based мониторинг, прометей
Prometheus - система мониторинга с открытым кодом, которая сама опрашивает сервисы по HTTP и собирает метрики - в отличие от push-систем, куда данные отправляют агенты. Разработана в SoundCloud и выпущена в open source в 2015 году, стала стандартом для контейнерных сред и Kubernetes. Для анализа данных используется язык запросов PromQL. Хранилище встроенное, временных рядов, без внешних зависимостей.
Статьи с этим термином · 127
- Управляемые сервисы IL-2 облаков в середине 2026: Selectel, SberCloud, VK Cloud · 23 июля 2026
- Два года на VictoriaMetrics + Grafana + Loki: что прижилось, где болит · 2 июня 2026
- FinOps в отечественном облаке: биллинг через API, ClickHouse и дашборды по командам · 30 апреля 2026
- OTel Logs GA: мигрируем последние сервисы с Fluent Bit на OpenTelemetry Collector · 17 марта 2026
- РЕД ОС 9.1: проверяем podman 5 и обновлённый crun с нашими Compose-манифестами · 26 февраля 2026
- ROSA Server 2.0 на YADRO: тестируем ARM-стек под веб-нагрузку · 10 февраля 2026
- Kubernetes 1.34 в Deckhouse и ROSA: graduated DRA и что с ним делать GPU-кластеру · 29 января 2026
- Мониторинг LLM-агента через OTel GenAI: как мы наконец увидели, что происходит внутри · 22 января 2026
- Thanos и Loki на отечественном S3: что получили после переезда у нескольких клиентов · 9 декабря 2025
- Kubernetes-оператор для Tantor в продакшне: failover, backup и мониторинг через Prometheus · 2 декабря 2025
- Patroni 4.0 и PostgreSQL 18: тестируем автоматический switchover под нагрузкой и разбираем новый мониторинг кластера · 23 октября 2025
- eBPF-трассировка на Astra Linux: полная картина задержек PostgreSQL и Kafka без единой строчки в коде приложений · 9 октября 2025
- Kafka 4.0 без ZooKeeper: как мы мигрировали продакшн-кластер на KRaft и что пошло не так с мониторингом · 23 сентября 2025
- OTel Collector для трёх клиентов: как единый стандарт убирает эксплуатационный мусор · 9 сентября 2025
- Deckhouse 1.68: CNI-изменения, новый Prometheus-оператор и staged rollout в продакшн · 7 августа 2025
- Grafana 12: переезд на новый движок алертинга при 500+ источниках данных · 31 июля 2025
- GPU-кластер для инференса LLM на отечественных серверах: архитектура, bottleneck'и и реальные цифры · 15 июля 2025
- Zabbix 7.2: встроенный anomaly detection на исторических данных и нативная Grafana без TSDB-прокси · 23 июня 2025
- Patroni 4.0 и quorum-репликация: переводим трёхнодовый кластер на синхронный режим · 12 июня 2025
- Loki 3.0 GA: обновляем стек логов и меряем, что изменилось с новым движком индексации · 9 июня 2025
- Ceph 20 Squid: обновляем продакшн-кластер и смотрим на latency RBD поверх NVMe · 13 марта 2025
- Anomaly detection в Zabbix 7.0: baseline вместо порогов, и когда это идёт не так · 18 ноября 2024
- Managed PostgreSQL в отечественных облаках: сравниваем Yandex Cloud, VK Cloud и Selectel · 28 октября 2024
- Yandex Cloud Managed Kubernetes 1.30: IAM, сетевая политика и стоимость egress для dev/staging · 23 сентября 2024
- Grafana 11.1 и Scenes API: перекраиваем инфра-дашборды под динамические переменные · 21 августа 2024
- Grafana 10.4: новый интерфейс алертов и работа с Loki без боли · 16 апреля 2024
- Deckhouse Kubernetes Platform и upstream 1.28: переводим клиента с kubeadm на отечественный дистрибутив · 1 февраля 2024
- Zabbix 6.4: включаем нативный HA и автообнаружение Kubernetes у клиентов · 28 декабря 2023
- Kafka 3.6 и KRaft: планируем миграцию с ZooKeeper, тестируем rolling migration в staging · 9 ноября 2023
- MinIO Distributed в отечественном облаке: разворачиваем self-hosted S3 как backend для резервных копий Veeam · 28 сентября 2023
- Deckhouse Monitoring Module: час до рабочего дашборда кластера без ручного YAML · 7 сентября 2023
- Ceph 18 Reef: обновляем продакшн-кластер с Quincy и меряем прирост на SSD · 28 августа 2023
- Deckhouse Kubernetes Platform 1.50+: переводим кластер разработки и смотрим, что внутри · 10 июля 2023
- AWX на Kubernetes operator: переезжаем с Docker Compose, подключаем Event-Driven Ansible · 1 июня 2023
- RedOS 7.3 + Deckhouse в продакшне объекта КИИ: что сломалось и как починили · 18 мая 2023
- Deckhouse Kubernetes Platform: разворачиваем CE и смотрим, что внутри · 26 января 2023
- MinIO self-hosted: строим S3-совместимое хранилище для нескольких клиентов и разбираемся с erasure coding · 6 декабря 2022
- Grafana 9.1: переезжаем на unified alerting и разбираемся с routing tree · 15 сентября 2022
- OpenTelemetry и Jaeger: ищем узкое место там, где метрики молчат · 23 августа 2022
- Proxmox VE 7.x как альтернатива VMware vSphere: первый пилот на 20 ВМ · 22 марта 2022
- Grafana 8.3/8.4 и unified alerting: мигрируем правила, собираем грабли · 8 февраля 2022
- Kubernetes 1.23 и PSP: начинаем миграцию на Pod Security Standards · 14 января 2022
- Kubernetes 1.23: HPA v2 в GA и KEDA для event-driven autoscaling · 22 ноября 2021
- Grafana Tempo в продакшне: S3 вместо Elasticsearch и прощание с Jaeger · 1 ноября 2021
- Grafana 8 + Tempo: разворачиваем distributed tracing и связываем его с метриками и логами · 6 сентября 2021
- Managed Kubernetes в Яндекс.Облаке: первый продакшн-проект, Terraform и CI/CD из GitLab · 25 февраля 2021
- SolarWinds Orion и SUNBURST: инвентаризируем мониторинг после самого громкого взлома 2020-го · 7 января 2021
- Kubernetes 1.20 GA: dockershim deprecated официально, начинаем миграцию · 10 декабря 2020
- OpenTelemetry Collector 0.14: один агент вместо трёх · 26 ноября 2020
- Grafana Loki 2.0: уходим от ELK в пользу лёгкого агрегатора логов для Kubernetes · 16 ноября 2020
- Grafana 7.2: library panels и трансформации без ETL · 19 октября 2020
- Ceph 15 Octopus GA: разворачиваем через cephadm и смотрим на dashboard для OSD latency · 24 сентября 2020
- Kafka 2.6: rolling upgrade с 2.4 и что incremental cooperative rebalancing меняет на практике · 17 августа 2020
- Postgres Operator от Zalando: разворачиваем PostgresCluster вместо ручных реплик · 3 августа 2020
- Prometheus 2.18 в продакшне: снижение памяти и перестройка remote_write под Thanos · 23 июня 2020
- Kubernetes 1.19 и 12-месячный цикл: строим матрицу совместимости до обновления · 9 июня 2020
- Kubernetes 1.18: ловим API deprecation warnings через audit log · 21 апреля 2020
- Ceph 15 Octopus в dev: смотрим на cephadm как замену ansible-ceph для раскатки кластеров · 21 января 2020
- Итоги 2019: Ansible в продакшне, первые Kubernetes-кластеры и КИИ-проекты, которые растянулись на весь год · 7 января 2020
- План на 2020: облако, GitOps на все кластеры и error budget в SLA · 30 декабря 2019
- Loki GA: развернули рядом с Prometheus и убрали Kibana из дежурного арсенала · 9 декабря 2019
- ClickHouse Kafka Engine в продакшне: от событий в топике до аналитики за секунды · 13 ноября 2019
- OpenTelemetry: следим за единым стандартом observability с момента анонса · 11 ноября 2019
- KubeFed v2 beta: пилот с двумя кластерами в разных ЦОД и почему это оказалось сложнее, чем выглядело · 14 октября 2019
- Jaeger в микросервисах: нашли узкое место за час, искали бы неделю · 25 сентября 2019
- Istio 1.2 vs Linkerd 2.5: гоняли оба на одном кластере, смотрели на ресурсы · 11 сентября 2019
- Ceph Nautilus в проде: наконец-то dashboard, который не врёт, и BlueStore без ручной настройки · 19 августа 2019
- Error budget в ретейле: как нарушения SLO за две недели убедили заказчика в canary · 7 августа 2019
- Kafka → ClickHouse с материализованным представлением: заменили двухчасовую SSIS-джобу на потоковый ETL · 24 июля 2019
- SLO на Prometheus: первый error budget и что он нам показал · 15 июля 2019
- Kubernetes 1.15 и зрелые CRD: начинаем оценивать операторы для StatefulSet-приложений · 1 июля 2019
- Zabbix 4.2 и Prometheus exporter: одна консоль для системных метрик и метрик приложений · 6 июня 2019
- OTel Collector как посредник: декаплируем приложения от Jaeger и Prometheus · 20 мая 2019
- KSQL на Kafka: аналитики пишут SQL, Java Streams лежат на полке · 8 мая 2019
- Ceph Nautilus в продакшне: встроенный Dashboard и прирост IOPS на BlueStore без замены железа · 8 апреля 2019
- Cisco Catalyst 9000 и SD-Access: сегментация через SGT работает, лицензии DNA Center - больно · 21 марта 2019
- Grafana Loki 0.1: логи рядом с Prometheus - проще, чем мы ожидали · 18 марта 2019
- Grafana 6.0: обновились, собрали единый dashboard и наконец увидели всю инфраструктуру · 14 марта 2019
- etcd 3.3 и backup-restore: проверили disaster recovery на реальном кластере Kubernetes · 7 марта 2019
- bpftrace на продакшне: ищем задержку в сетевых очередях без остановки сервисов · 14 февраля 2019
- Thanos и remote_write: когда 90 дней метрик Prometheus перестают помещаться · 21 января 2019
- Итоги 2018: Kubernetes в продакшн, Windows Server 2019 и первые реальные аудиты по 187-ФЗ · 17 декабря 2018
- Elastic 6.5: мониторинг кластера и SQL теперь бесплатны - пересматриваем ценность Gold · 28 ноября 2018
- Kubernetes NetworkPolicy с Calico: неделя проектирования, зато east-west трафик под контролем · 5 ноября 2018
- Alertmanager 0.15: многоуровневый routing и silence management - как мы победили alert fatigue · 24 октября 2018
- ClickHouse 1.1.54388: Materialized Views вместо ночных ETL-задач на 500M строк событий безопасности · 19 сентября 2018
- Grafana 5.2: дашборды и datasource в Git - мониторинг как код · 27 августа 2018
- eBPF в продакшне: bcc-tools и bpftrace показали латентность без ребута · 20 августа 2018
- Docker Compose v3, Swarm и Kubernetes: что выбрать для небольшого проекта · 6 августа 2018
- Istio 0.8 LTS: mTLS между микросервисами заработал, Kiali показал кто с кем разговаривает · 16 июля 2018
- Prometheus 2.3: мигрировали с 1.x на 2.x - новая TSDB и WAL меняют картину · 11 июля 2018
- Kubernetes 1.11: мигрируем с kube-dns на CoreDNS и настраиваем split-horizon · 4 июля 2018
- Kubernetes 1.11: IPVS-режим kube-proxy и CoreDNS - что изменилось на практике · 2 июля 2018
- Kubernetes Operators: полугодовой итог - Zalando Postgres Operator в продакшне · 26 июня 2018
- Grafana 5.1 provisioning: дашборды в Git, автозагрузка при деплое · 19 июня 2018
- Prometheus Operator в prod: ServiceMonitor CRD и monitoring-as-code на практике · 12 июня 2018
- Kafka Streams как шина событий: уходим от REST-вызовов между микросервисами · 25 мая 2018
- Envoy Proxy 1.6: разбираем xDS API и sidecar-паттерн для observability без правок в коде · 20 апреля 2018
- Kubernetes Operators: CoreOS объясняет как управлять stateful-приложениями через Custom Resources · 27 марта 2018
- BlueStore в первом продакшн-кластере: +40% throughput и меньше CPU · 20 марта 2018
- Helm 2.8: stable-репозиторий закрывает типовые задачи, но Tiller беспокоит · 6 марта 2018
- Prometheus 2.0: новый TSDB и план миграции с 1.x без боли · 2 февраля 2018
- Приоритеты на 2018: Meltdown/Spectre, акты КИИ и k8s в продакшне · 28 декабря 2017
- ClickHouse 1.1.54310: Materialized Views с фильтрами и ARRAY JOIN для сетевых flow-данных · 27 ноября 2017
- etcd 3.2 в боевом Kubernetes: Watch API быстрее, алерты - раньше · 9 ноября 2017
- ZFS on Linux 0.7.0 GA: переводим NAS-сервер на свежий релиз и подключаем Prometheus · 31 августа 2017
- Prometheus 2.0 alpha: новый TSDB движок и remote read/write API · 31 июля 2017
- Ceph Luminous GA: переводим тестовый кластер с FileStore на BlueStore · 13 июля 2017
- Prometheus 1.7 в продакшне: тюнинг retention, compaction и federation для нескольких площадок · 22 июня 2017
- Helm 2 и ChartMuseum: управление пакетами Kubernetes в продакшне · 23 мая 2017
- Docker Swarm Mode vs Kubernetes: честное сравнение после года в проде · 20 апреля 2017
- Grafana 4 alerting: когда дашборд умеет звонить, и зачем это нужно рядом с Alertmanager · 13 апреля 2017
- Реестр отечественного ПО в 2017: аудит у клиента с госучастием · 28 марта 2017
- GitLab 9.0: Review Apps и Prometheus из коробки - заканчиваем переезд с Jenkins · 2 марта 2017
- Prometheus 1.5 в продакшне: node-exporter, cAdvisor и первые alert-правила · 14 февраля 2017
- Итоги 2016: контейнеры в пилот, Let's Encrypt переломил TLS, 152-ФЗ стал практикой · 3 января 2017
- Итоги 2016: Windows Server 2016, Mirai и контейнеры взрослеют · 26 декабря 2016
- Apache Spark 2.0 в продакшне: Structured Streaming вместо hourly batch · 14 декабря 2016
- Переходим на Elastic Stack 5.0: X-Pack Security убирает Elasticsearch из DMZ · 16 ноября 2016
- Grafana 3.x + Elasticsearch: метрики и логи в одном дашборде · 21 сентября 2016
- Zabbix 3.0 LTS: мигрируем с 2.4, разбираемся с новым dashboard и меньшей нагрузкой на БД · 24 августа 2016
- Prometheus + Alertmanager: первый опыт рядом с Zabbix · 13 июля 2016
- Итоги первого полугодия 2016: TLS стал дешёвым, контейнеры повзрослели, реестр ПО давит · 28 июня 2016
- Prometheus 1.0: переводим боевой k8s-кластер на pull-мониторинг полностью · 24 июня 2016
- Zabbix на Docker-хостах: почему мы ушли на Prometheus и Grafana · 9 февраля 2016
- Итоги 2015: контейнерная зрелость и регуляторный год · 29 декабря 2015
- Prometheus 0.16: попробовали pull-модель мониторинга для Docker-контейнеров · 24 ноября 2015