Estoy interesado en entender cómo otros administradores de ArcGIS Enterprise están manejando el respaldo y la recuperación ante desastres en implementaciones reales.
A lo largo de los años, hemos encontrado repetidamente desafíos con los respaldos de WebGIS DR:
- La creación del respaldo puede tomar muchas horas o incluso días.
- Los entornos grandes pueden producir archivos de respaldo que se acercan o superan cientos de gigabytes.
- Los trabajos de respaldo ocasionalmente fallan o se agotan, requiriendo intervención manual.
- Las pruebas de recuperación suelen ser lentas y operativamente complejas.
- A medida que los entornos continúan creciendo, las ventanas de respaldo se vuelven cada vez más difíciles de mantener.
En nuestro caso, los respaldos de WebGIS DR pueden tomar hasta 16 horas para aproximadamente 900 GB de datos, lo que dificulta realizar respaldos con la frecuencia suficiente para cumplir con los objetivos de recuperación.
Lo que hace esto particularmente desafiante es que la documentación y las interacciones con soporte de Esri consistentemente posicionan WebGIS DR como el mecanismo oficialmente soportado para respaldo y recuperación de ArcGIS Enterprise.
Al mismo tiempo, la mayoría de las organizaciones ya están utilizando capacidades maduras de respaldo nativas en la nube proporcionadas por Azure, AWS, GCP, VMware, plataformas de almacenamiento u otras soluciones a nivel de infraestructura. Estas tecnologías típicamente ofrecen:
- Ejecución más rápida del respaldo
- Respaldos incrementales
- Recuperación basada en snapshots
- Flujos de trabajo probados para recuperación ante desastres
- Menor carga operativa
Esto plantea una pregunta honesta:
¿Qué ventaja práctica ofrece WebGIS DR sobre las soluciones de respaldo a nivel de infraestructura, especialmente en implementaciones Enterprise más grandes?
Nuestros propios ejercicios de recuperación ante desastres se han basado principalmente en respaldos a nivel de infraestructura combinados con procedimientos documentados de recuperación. Aunque WebGIS DR sigue siendo parte de la estrategia general, cada vez se está convirtiendo en el componente más lento, que consume más recursos y menos flexible del proceso de respaldo.
Preguntas para la comunidad
- ¿Siguen usando WebGIS DR como su mecanismo principal de recuperación ante desastres?
- ¿Combinan WebGIS DR con respaldos nativos en la nube (Azure Backup, AWS Backup, snapshots, VMware snapshots, etc.)?
- Si es así, ¿en qué solución confían más realmente en un escenario real de recuperación ante desastres?
- ¿Alguien ha dejado completamente los respaldos regulares de WebGIS DR y confía principalmente en respaldos a nivel de infraestructura?
- ¿Han discutido este enfoque con Soporte Esri y, si es así, qué orientación recibieron?
- ¿Existen organizaciones que ejecutan exitosamente entornos Enterprise muy grandes donde WebGIS DR sigue siendo práctico?
No estoy buscando consejos para solucionar problemas en una implementación específica.
Más bien, estoy interesado en entender si existe una brecha creciente entre la recomendación oficial de usar WebGIS DR y lo que las organizaciones están haciendo realmente operativamente en producción.
Me interesaría mucho saber cómo otros han abordado este desafío.