Backup и recovery
Retention, резервное копирование, восстановление и проверка целостности.
Backup и recovery
Backup защищает критичное платформенное состояние, но не превращает ESB в архив бизнес-сообщений. Для каждого компонента отдельно определяются live retention, backup scope, RPO, RTO и restore procedure.
Общие правила
- ESB не является system of record для банковских бизнес-данных;
- transient payload удаляется по retention policy;
- metadata/configuration и runtime data имеют разные backup requirements;
- Dev, Stage и Prod не разделяют backup sets;
- backup шифруется и имеет ограниченный доступ;
- restore регулярно проверяется практически.
Матрица компонентов
| Компонент | Что защищаем | Recovery focus |
|---|---|---|
| WSO2 | API metadata, applications, subscriptions, users/roles, policies | Восстановить management/runtime configuration |
| Kafka | Cluster/topic configuration; payload — только по отдельной policy | Восстановить transport, избежать неконтролируемого replay |
| Kestra | Flows, execution metadata и state | Восстановить definitions и определить судьбу executions |
| PostgreSQL | Служебные схемы компонентов | Full restore/PITR согласно service profile |
| Adapters | Config и минимальное техническое state | Восстановить connectivity и idempotency state |
| Callback | Pending delivery/retry state | Не потерять и не задублировать уведомления |
Retention не равен backup
Наличие сообщения в Kafka в пределах retention не заменяет резервное копирование конфигурации. Backup базы также не гарантирует корректный replay внешней бизнес-операции.
Backup controls
- расписание и успешность jobs;
- encryption at rest/in transit;
- access and audit;
- immutable/offsite copy при необходимости;
- expiry и cleanup;
- alert при пропуске backup;
- документированная совместимость версий.
Restore procedure
- Определить incident scope и recovery point.
- Остановить conflicting writes/producers.
- Подтвердить backup integrity и совместимость версии.
- Восстановить в изолированный target или по утверждённой процедуре.
- Проверить schema, configuration и secrets references.
- Запустить component health checks.
- Выполнить функциональную проверку reference flow.
- Провести reconciliation pending operations.
- Открыть трафик контролируемо.
Restore test
Успешный backup считается доказанным только после restore test. Результат содержит дату, backup ID, target, duration, фактические RPO/RTO, проверки и замечания.
Data cleanup
Cleanup выполняется автоматически и наблюдаемо. Любое увеличение retention требует оценки storage, privacy/security и влияния на recovery.