СИСТЕМА АВТОМАТИЧНОГО АВАРІЙНОГО ВІДНОВЛЕННЯ ІНФОРМАЦІЙНИХ ВЕБРЕСУРСІВ У ХМАРНОМУ СЕРЕДОВИЩІ
Ключові слова
Анотація
Проаналізовано сучасні підходи до аварійного відновлення (Disaster Recovery) вебдодатків у хмарних середовищах та гібридних інфраструктурах. Розглянуто основні моделі Disaster Recovery, такі як Backup-and-Restore, Warm Standby, Multi-AZ та Multi-Region, а також їхні переваги й обмеження з погляду вартості реалізації, швидкості відновлення та вимог до обчислювальних ресурсів. Особливу увагу приділено сценаріям, у яких локальні сервери поєднуються з хмарними сервісами Amazon Web Services, що дають можливість досягнути балансу між економічністю рішення та високою відмовостійкістю.
Досліджено механізми автоматизації процесів відновлення, зокрема роль Amazon Route 53 Health Check, CloudWatch Alarm, SNS та Lambda як тригерів і основних компонентів DR-алгоритму.
Розроблено систему автоматичного аварійного відновлення вебресурсів у гібридному середовищі AWS, яка базується на автоматичному перемиканні на резервне середовище та вибірковому відновленні лише критично важливих компонентів системи. Побудовано математичні моделі оцінювання показників RTO та RPO, які враховують часові затримки на виявлення збоїв, відновлення бази даних, запуск застосунку та оновлення DNS-маршрутів. Розроблено підходи до відновлення даних на основі періодичного резервного копіювання у S3 та безперервної реплікації за допомогою AWS Database Migration Service. Доведено, що традиційні підходи, які потребують повного дублювання інфраструктури, є ресурсомісткими та недостатньо гнучкими для умов з динамічно змінним рівнем доступності локальних ресурсів.
Виконано розгортання тестового вебресурсу у хмарному середовищі AWS. Спроектовано високодоступну інфраструктуру з використанням сервісів Amazon, усі компоненти якої створено з використанням підходу Infrastructure as Code засобами Terraform, що забезпечує повторюваність, керованість і можливість швидкого розгортання рішень у різних середовищах.
За результатами проведеного моделювання та тестування системи встановлено суттєве скорочення часу простою вебресурсу у разі застосування запропонованої системи аварійного відновлення порівняно з традиційними DR-стратегіями.
