Для клиента с небольшой on-premise базой данных план аварийного восстановления (Disaster Recovery, DR) и настройка репликации будут включать следующие шаги:
Как вы будете строить план аварийного восстановления и настраивать репликацию для клиента с небольшой базой данных on-premise?
Для клиента с небольшой on-premise базой данных план аварийного восстановления (Disaster Recovery, DR) и настройка репликации будут включать следующие шаги:
Короткий ответ
Что ответить на собеседовании
Подробный разбор
Ответ с пояснениями
Для клиента с небольшой on-premise базой данных план аварийного восстановления (Disaster Recovery, DR) и настройка репликации будут включать следующие шаги:
- Оценка требований: определить RPO (Recovery Point Objective) и RTO (Recovery Time Objective) — насколько свежими должны быть данные и как быстро нужно восстановиться.
- Резервное копирование: настроить регулярные бэкапы (полные и инкрементальные), хранить их на отдельном носителе или удалённом сервере.
- Репликация: для небольшой базы можно использовать асинхронную репликацию на второй сервер, чтобы иметь актуальную копию данных. Например, в PostgreSQL — настроить streaming replication.
- Тестирование восстановления: регулярно проверять, что из резервных копий и реплик можно быстро восстановить базу.
- Документирование: составить подробный план действий при сбое.
Пример настройки репликации в PostgreSQL (очень упрощённо):
# На primary сервере в postgresql.conf:
wal_level = replica
max_wal_senders = 3
# В pg_hba.conf добавить доступ для standby
# На standby сервере выполнить:
pg_basebackup -h primary_host -D /var/lib/postgresql/data -P -U replicator
# Запустить standby с recovery.conf, указывающим primary