Learning IT / Monitoring

Мониторинг и observability

Мониторинг позволяет увидеть состояние инфраструктуры, а observability помогает понять причины поведения сложной распределенной системы.

student@lab:~$ learn monitoring
Loading topic...
theory
practice
troubleshooting

Topic ready.

О направлении

Метрики, логи, трассировки, Prometheus, Grafana и основные принципы наблюдаемости систем.

Метрики

Метрики хорошо подходят для трендов, алертов и численных показателей состояния системы.

Логи

Логи дают контекст конкретных событий и помогают понять последовательность действий приложения.

Трассировки

Distributed tracing особенно полезен для поиска задержек в микросервисных системах.

Как изучать тему

Лучший подход — сочетать короткую теорию с практикой в тестовой среде. После каждого блока полезно воспроизводить типовые неисправности и документировать способ диагностики.

Связанные материалы

Продолжить изучение можно через общий roadmap, а также разделы Linux, Networking, DevOps и Monitoring.