Мониторинг через Burn Rate: как перестать получать ложные алерты

Почему статические пороги не работают Наивный подход к мониторингу заключается в настройке статических порогов — например, оповещение при превышении 1% ошибок в течение пяти минут. Это тот подход, который мы рассматривали ранее в статье Prometheus vs Zabbix. — alert: HighErrorRate…

Read more

Как успешно пройти онбординг в SRE: советы пилота

Аналогия SRE-онбординга: искусство смены типа воздушного судна В авиационной индустрии существует понятие Type Conversion — процесс переучивания пилота на новый тип самолета. Пилоту не приходится учиться летать с нуля, ведь законы аэродинамики остаются неизменными. Однако расположение приборов, логика управления и…

Read more

Updo: профессиональный мониторинг сайтов из терминала

Что такое Updo? Updo — это современный инструмент командной строки, разработанный для глубокого мониторинга веб-ресурсов. Он позволяет в режиме реального времени отслеживать доступность сайтов, анализировать время отклика и контролировать состояние SSL-сертификатов. Инструмент ориентирован на системных администраторов и DevOps-инженеров, которым требуется…

Read more

Htop под микроскопом: как глубоко понимать метрики Linux

Многие системные администраторы и DevOps-инженеры воспринимают htop как базовый инструмент для мониторинга, однако за его простым интерфейсом скрывается глубокая механика взаимодействия с ядром Linux. Понимание того, как именно эта утилита получает данные, позволяет не просто наблюдать за системой, но и…

Read more

Как настроить мониторинг бекапов по принципу «переключателя мертвеца»

Мониторинг резервного копирования: стратегия «Dead Man’s Switch» В предыдущей статье мы обсуждали настройку PITR-бекапов для PostgreSQL. Сегодня мы затронем критически важную тему — мониторинг процесса резервного копирования. Распространенная проблема заключается в том, что после добавления скрипта бэкапа в crontab администраторы…

Read more

Inspektor Gadget: эффективная отладка Kubernetes с помощью eBPF

При администрировании Kubernetes технологии eBPF открывают доступ к мониторингу каждого системного вызова (syscall) и сетевого пакета на уровне ядра Linux. Однако сырые данные часто не дают прямого ответа на критический вопрос: какой именно Pod, контейнер или Namespace инициировал событие? Решением…

Read more

Дайджест DevOps: эмулятор AWS kumo, аудит Prometheus и OpenTelemetry без лишних коллекторов

Мир DevOps постоянно развивается, предлагая новые инструменты для упрощения эксплуатации и ускорения разработки. В этом обзоре мы собрали самые интересные обновления и утилиты, которые помогут оптимизировать вашу инфраструктуру и процессы CI/CD. Обновление Kubernetes 1.36 Недавно состоялся релиз Kubernetes 1.36. Мы…

Read more

Procs: Современная альтернатива ps на Rust для комфортной работы

Смотрите на вывод ps aux и чувствуете, как глаза начинают слезиться? Тысячи строк однообразного текста, где нужный процесс прячется за системными демонами, а для поиска приходится постоянно вызывать grep. В современном Linux администрировании есть инструменты на порядок удобнее. Что такое…

Read more