# TASK 002: Production Hardening ## Цель Повысить надежность промышленного контура AWatch-rus при отказах источников, перегрузке сервисов и частичной потере данных. ## Объем - Fail-closed поведение для критичных API. - Bounded timeouts и отсутствие каскадных тяжелых повторов. - Stale cache fallback там, где это безопасно. - Health/status, которые честно показывают degraded-состояние. - Операторские runbook для восстановления. ## Ограничения - Не скрывать degraded-состояния за зеленым health. - Не делать ClickHouse обязательной зависимостью worktime reports. - Не логировать чувствительные runtime-идентификаторы. ## Результат Система контролируемо деградирует, не создает каскадную нагрузку и дает оператору понятный порядок восстановления.