Отказоустойчивость контейнерной инфраструктуры: кластеризация, распределение нагрузки и катастрофоустойчивость (Disaster Recovery)
В ходе вебинара эксперты компании АРТ-Финтех расскажут о современных подходах к построению высокодоступной контейнерной инфраструктуры для финансовых организаций, обеспечивающей непрерывную работу критически важных сервисов даже при отказах оборудования, программного обеспечения или целых площадок.
В программе вебинара:
1. Отказоустойчивый контейнерный кластер
- уровни отказоустойчивости контейнерной инфраструктуры;
- кластеризация управляющих и рабочих узлов;
- репликация сервисов и автоматическое восстановление приложений;
- устранение единых точек отказа.
2. Распределение и балансировка нагрузки
- балансировка внешнего трафика;
- Ingress-контроллеры и сервисная балансировка;
- горизонтальное масштабирование приложений;
- обработка пиковых нагрузок;
- автоматический контроль доступности сервисов.
3. Отказоустойчивость данных и хранилищ
- обеспечение высокой доступности PostgreSQL, MongoDB и других баз данных;
- отказоустойчивые поисковые кластеры OpenSearch/ELK;
- распределённые файловые и блочные хранилища (Piraeus/LINSTOR, Ceph);
- защита данных, репликация и восстановление после сбоев;
- различия между репликацией, резервным копированием и архивным хранением.
4. Распределённые площадки и Disaster Recovery
- построение инфраструктуры в нескольких дата-центрах;
- схемы Active-Passive, Active-Active и «тёплый» резерв;
- один распределённый кластер или несколько независимых кластеров;
- синхронизация приложений, баз данных и хранилищ;
- показатели RTO и RPO;
- сценарии переключения на резервную площадку и возврата после аварии.
Практический пример
В завершение вебинара будет рассмотрен пример построения отказоустойчивой контейнерной платформы, включающей прикладные сервисы, базы данных, поисковый кластер и распределённое хранилище.