Эксплуатационная модель
Ownership, operational readiness и ежедневное сопровождение MTB ESB.
Operations & Reference
Эксплуатация MTB ESB охватывает весь маршрут запроса: WSO2, Event Router, Kafka, Kestra, адаптеры, Callback Service, базы данных и инфраструктуру окружения.
Цель раздела
Поддержка должна определять состояние интеграции по наблюдаемым сигналам и выполнять безопасное восстановление по runbook, не полагаясь на знания отдельного разработчика.
Операционные контуры
| Контур | Что контролируется |
|---|---|
| Consumer/API | Availability, latency, status codes, throttling |
| WSO2 | Gateway health, traffic, policies, subscriptions, DB connectivity |
| Transport | Kafka availability, producer errors, consumer lag, DLQ |
| Orchestration | Failed/stuck executions, queue, duration, retries |
| Adapters | Target connectivity, error rate, timeout, resource usage |
| Callback | Delivery success, retries, signature errors, DLT |
| Infrastructure | Kubernetes, nodes, ingress, network, storage, certificates |
Operational readiness
Компонент или API готов к сопровождению, если:
- назначен service owner и support owner;
- определены health checks, dashboards и alerts;
- logs, metrics и traces доступны в общем стеке;
- утверждены SLI/SLO или временный service profile;
- описаны типовые failure modes;
- подготовлены restart, rollback и recovery procedures;
- определены backup/restore requirements;
- настроен escalation path;
- проведён handover команде поддержки.
Общий стек наблюдаемости
Диаграмма отражает целевой baseline из проектных материалов. Фактическая готовность каждой интеграции подтверждается environment readiness checklist.
Приоритет оператора
- Защитить клиентов и данные.
- Определить blast radius.
- Остановить ухудшение ситуации.
- Восстановить минимально необходимый сервис.
- Собрать evidence и устранить причину.
- Обновить runbook и monitoring.
Быстрые переходы
Observability
Метрики, логи, трассы, dashboards и alerts.
Performance testing
Baseline, ramp-up, peak/recovery и критерии готовности E2E-цепочки.
Диагностика и инциденты
Поиск запроса и управление инцидентом.
Deployment и rollback
Безопасная поставка и восстановление версии.
Runbooks и support
Шаблоны процедур и escalation model.