Distributed Tracing
Также: distributed tracing, распределённая трассировка, трейсинг, Jaeger, Zipkin
Distributed Tracing - метод наблюдаемости, при котором каждый входящий запрос получает уникальный trace ID и порождает spans во всех сервисах, через которые проходит. Span фиксирует отрезок работы: имя операции, время начала и конца, атрибуты и возможные ошибки. Собранные spans объединяются в единое дерево вызовов, по которому видно, где цепочка тормозит или ломается. Популярные реализации - Jaeger и Zipkin; оба поддерживают стандарт OpenTelemetry.
Статьи с этим термином · 11
- OpenTelemetry и Jaeger: ищем узкое место там, где метрики молчат · 23 августа 2022
- Grafana Tempo в production: S3 вместо Elasticsearch и прощание с Jaeger · 1 ноября 2021
- Grafana 8 + Tempo: разворачиваем distributed tracing и связываем его с метриками и логами · 6 сентября 2021
- OpenTelemetry Collector 0.14: один агент вместо трёх · 26 ноября 2020
- OpenTelemetry: следим за единым стандартом observability с момента анонса · 11 ноября 2019
- Jaeger в микросервисах: нашли узкое место за час, искали бы неделю · 25 сентября 2019
- Istio 1.2 vs Linkerd 2.5: гоняли оба на одном кластере, смотрели на ресурсы · 11 сентября 2019
- Istio 1.2 в тестовом кластере: mTLS закрыл давнюю задачу по east-west трафику · 8 июля 2019
- OTel Collector как посредник: декаплируем приложения от Jaeger и Prometheus · 20 мая 2019
- Istio 1.1 в production: mTLS между сервисами через CRD и трассировка Jaeger без правок кода · 18 апреля 2019
- OpenTelemetry: слияние OpenTracing и OpenCensus и что это значит для наших микросервисов · 11 февраля 2019