Je souhaite comprendre comment d'autres administrateurs ArcGIS Enterprise gèrent la sauvegarde et la reprise après sinistre dans des déploiements réels.
Au fil des ans, nous avons rencontré à plusieurs reprises des défis avec les sauvegardes WebGIS DR :
- La création de sauvegardes peut prendre de nombreuses heures voire des jours.
- Les grands environnements peuvent produire des fichiers de sauvegarde approchant ou dépassant plusieurs centaines de gigaoctets.
- Les tâches de sauvegarde échouent ou expirent parfois, nécessitant une intervention manuelle.
- Les tests de récupération sont souvent longs et opérationnellement complexes.
- À mesure que les environnements continuent de croître, les fenêtres de sauvegarde deviennent de plus en plus difficiles à maintenir.
Dans notre cas, les sauvegardes WebGIS DR peuvent prendre jusqu'à 16 heures pour environ 900 Go de données, ce qui rend difficile la réalisation de sauvegardes suffisamment fréquentes pour atteindre les objectifs de récupération.
Ce qui rend cela particulièrement difficile, c'est que la documentation Esri et les interactions avec le support positionnent systématiquement WebGIS DR comme le mécanisme officiel de sauvegarde et de récupération pour ArcGIS Enterprise.
En même temps, la plupart des organisations utilisent déjà des capacités matures de sauvegarde cloud-native fournies par Azure, AWS, GCP, VMware, des plateformes de stockage ou d'autres solutions au niveau infrastructure. Ces technologies offrent généralement :
- Une exécution plus rapide des sauvegardes
- Des sauvegardes incrémentielles
- Une récupération basée sur des instantanés
- Des workflows éprouvés de reprise après sinistre
- Une charge opérationnelle réduite
Cela soulève une question honnête :
Quel avantage pratique WebGIS DR offre-t-il par rapport aux solutions de sauvegarde au niveau infrastructure, surtout dans les grands déploiements Enterprise ?
Nos propres exercices de reprise après sinistre ont principalement reposé sur des sauvegardes infrastructure combinées à des procédures de récupération documentées. Bien que WebGIS DR reste une partie intégrante de la stratégie globale, il devient de plus en plus le composant le plus lent, le plus gourmand en ressources et le moins flexible du processus de sauvegarde.
Questions pour la communauté
- Utilisez-vous encore WebGIS DR comme principal mécanisme de reprise après sinistre ?
- Combinez-vous WebGIS DR avec des sauvegardes cloud-native (Azure Backup, AWS Backup, instantanés, instantanés VMware, etc.) ?
- Si oui, quelle solution faites-vous réellement le plus confiance dans un scénario réel de reprise après sinistre ?
- Quelqu'un a-t-il complètement abandonné les sauvegardes régulières WebGIS DR pour s'appuyer principalement sur des sauvegardes au niveau infrastructure ?
- Avez-vous discuté d'une telle approche avec le support Esri, et si oui, quels conseils avez-vous reçus ?
- Existe-t-il des organisations qui exploitent avec succès des environnements Enterprise très vastes où WebGIS DR reste pratique ?
Je ne cherche pas des conseils de dépannage pour un déploiement spécifique.
Je souhaite plutôt comprendre s'il existe un fossé croissant entre la recommandation officielle d'utiliser WebGIS DR et ce que les organisations font réellement opérationnellement en production.
Je serais très intéressé d'entendre comment d'autres ont abordé ce défi.