Симптом ≠ root cause: проверка результата в диагностике
Напоминание для диагностики: корреляция не равна доказательству, изменение конфигурации требует проверки результата. Кейс Zabbix.
Мы разбираем инфраструктуру по фактам: Linux, Zabbix, мониторинг, диагностика и архитектура. От симптома — к проверяемому выводу: что именно доказывает метрика, какие гипотезы остаются и как подтвердить решение. Без догадок там, где можно проверить. Если нужно понимать не только что сделать, но и почему — вам сюда.
Напоминание для диагностики: корреляция не равна доказательству, изменение конфигурации требует проверки результата. Кейс Zabbix.
Разбор: почему большая очередь Zabbix (170 000 items) — симптом, а не root cause; список мест, где искать задержку.
Короткое определение элементов evidence для бэкапов: конфигурация, job, артефакт и тест восстановления; почему важна проверка восстановимости.
Разбор пяти уровней проверки резервных копий — от настройки до реального восстановления; акцент на recoverability и проверяемых доказательствах.
Краткая методика диагностики нагрузки pollers в Zabbix: когда увеличение StartPollers оправдано, какие метрики проверить и как валидировать изменение.
Разбор случая poller processes ≈100% в Zabbix: почему 100% не обязательно означает нехватку StartPollers и какие метрики проверить.
Разбор, что реально подтверждает systemd‑статус active (running) и какие дополнительные проверки нужны для проверки доступности сервиса (nginx).
Практические материалы о Linux, Zabbix, мониторинге и диагностике с акцентом на проверяемые выводы и проверку гипотез.