Choix de la solution
Elasticsearch propose deux solutions pour la reprise après sinistre hors site :
Sauvegarde et restauration par snapshot OSS : sauvegarde les données d'index dans Alibaba Cloud Object Storage Service (OSS). Le premier snapshot est une sauvegarde complète, tandis que les suivants sont incrémentiels. Vous pouvez restaurer les données vers une autre instance Elasticsearch via un référentiel OSS inter-clusters. Pour plus d'informations, consultez la rubrique Sauvegarder et restaurer des données à l'aide d'un référentiel OSS inter-clusters.
Réplication inter-clusters (CCR) : réplique de manière asynchrone et incrémentielle les index accessibles en écriture depuis un cluster leader vers un ou plusieurs clusters follower, permettant une synchronisation quasi temps réel. Cette solution est idéale pour la reprise après sinistre avec des exigences strictes en matière de RPO et de RTO. Pour plus d'informations, consultez la rubrique Répliquer des données entre clusters à l'aide de la CCR.
Comparaison des solutions
|
Solution |
Scénarios |
RPO |
RTO |
Principales limites |
|
Snapshot OSS |
Sauvegarde et restauration périodiques de volumes de données importants (du Go au Po). |
De quelques heures à plusieurs jours (selon l'intervalle entre les snapshots). |
Plusieurs heures (selon le volume de données et la restauration des shards). |
Aucune synchronisation continue. Une interruption de service peut être nécessaire lors de la restauration. |
|
CCR |
Reprise après sinistre hors site, séparation lecture/écriture et accès basé sur la proximité géographique. |
Quasi nul (quelques secondes). |
De quelques secondes à quelques minutes. |
Les index follower sont en lecture seule. Les mappings et le nombre de shards doivent être identiques. |
Pour une reprise après sinistre hors site exigeant un RPO faible et une disponibilité en temps réel, nous recommandons la CCR :
Synchronise les données en quelques secondes, minimisant ainsi la perte de données.
En cas de défaillance du cluster principal, basculez immédiatement le trafic vers le cluster follower sans attendre la restauration d'un snapshot.
Bien que le coût initial soit plus élevé, cette solution s'avère plus rentable à long terme en prévenant les pertes commerciales liées à l'indisponibilité des données.