Настройка и эксплуатация

План реагирования на инцидент маршрутизации

Во время инцидента сначала стабилизируют безопасный путь и доказательства, а уже затем меняют правила на основании проверенной причины.

Быстро оцените область влияния

Определите затронутые потоки, источники, рынки, назначения, начало и наблюдаемый симптом. Отделите неверное решение от недоступной страницы, DNS и потери атрибуции.

Ограничьте ущерб обратимым действием

Переведите конкретный поток на безопасное назначение, приостановите слабый сегмент или верните известную конфигурацию. Не меняйте глобальный порог без доказательства широкой проблемы. Так вы сохраните локальный и обратимый характер вмешательства.

Сохраните временные доказательства

Зафиксируйте события, версии настроек, адреса, ответы, время и владельцев до очистки или повторного развёртывания. Не записывайте секреты и лишние персональные данные в общий канал.

Найдите неисправный слой

Проверяйте последовательно DNS и TLS, входные параметры, классификацию, приоритет правил, решение, доставку и страницу. Меняйте по одной переменной, чтобы исправление имело объяснимую причину.

Восстанавливайте с контрольным окном

Повторите исходный сбой и соседние приёмочные случаи, затем постепенно верните трафик под наблюдением. Документируйте причину, исправление, побочные эффекты и действие, предотвращающее повтор. Итоговый отчёт должен объяснять каждое принятое решение.

Материалы по теме