5 razones por las que fracasan los planes de recuperación ante desastres

Es una situación que todo equipo de TI teme. Realizas con esmero copias de seguridad de los servidores críticos en tu dispositivo local o en la nube, pero cuando se produce un incidente y más las necesitas, la recuperación de la copia de seguridad falla.

Veamos por qué falla la recuperación ante desastres y cómo puedes evitar los factores que provocan ese fallo:

1. No identificar ni comprender las dependencias de recuperación

Los planes de recuperación ante desastres suelen incluir estrategias de copia de seguridad y retención de datos que no definen de forma exhaustiva las dependencias y los requisitos necesarios para una recuperación ante desastres sin contratiempos. No ajustar los planes de copia de seguridad a las expectativas específicas de restauración puede tener consecuencias devastadoras.

La recuperación del funcionamiento del servidor es solo el principio

En el caso de las operaciones empresariales que se ejecutan en aplicaciones de varios niveles o de N niveles, no basta con restablecer simplemente el funcionamiento del servidor. En estos entornos, las funciones de procesamiento, gestión de datos y presentación pueden estar alojadas en diferentes máquinas que deben comunicarse entre sí a la perfección. Si se realiza una copia de seguridad de estos componentes con intervalos diferentes o se restauran con un orden de arranque incorrecto o en un host con una red virtual diferente, la comunicación entre ellos podría interrumpirse. Como consecuencia, la recuperación ante desastres fracasará, se podrían perder datos y se podrían perder muchas horas solucionando los problemas.

Problemas de configuración

Los problemas de configuración en el entorno de producción pueden poner en peligro la recuperación ante desastres. Por ejemplo, al configurar entornos de servidores virtuales como destinos de copia de seguridad, es necesario asignar espacio para las instantáneas, de modo que puedan ejecutarse y guardarse correctamente.

Consejos para identificar las dependencias críticas y garantizar el éxito de las recuperaciones:

  • Analiza diferentes situaciones de interrupción del servicio y repasa los pasos concretos que deberás seguir para restablecer el servicio a los usuarios finales. Examina cada paso del proceso para detectar posibles dependencias u obstáculos para la recuperación ante desastres.
  • Documenta las dependencias críticas —orden de arranque, requisitos de las aplicaciones, etc.— e incorpóralas en los pasos de recuperación.

2. Comprender y evitar los problemas de compatibilidad del software

Existe una amplia variedad de problemas de compatibilidad de software que pueden hacer que los datos resulten irrecuperables. El Servicio de Copias de Sombra de Volumen (VSS) de Microsoft es una fuente habitual de problemas de compatibilidad. Sin embargo, las nuevas tecnologías de copia de seguridad y recuperación ante desastres en la nube están incorporando software avanzado de autorreparación para resolver los problemas de compatibilidad. Esta tecnología detecta automáticamente los problemas de compatibilidad con VSS, las configuraciones erróneas y una amplia gama de amenazas para la recuperabilidad. El software resuelve los conflictos de VSS, reinicia las copias de seguridad y lleva a cabo una serie de medidas adicionales para solucionar los problemas de copia de seguridad antes de que pongan en peligro la recuperación, sin necesidad de que intervenga el equipo de TI.

3. Pruebas insuficientes

Los equipos de TI siguen teniendo dificultades para encontrar el tiempo y los recursos necesarios para realizar pruebas de recuperación ante desastres con la frecuencia suficiente como para garantizar que las recuperaciones se lleven a cabo según lo previsto. Sin embargo, probar las copias de seguridad es esencial para que la recuperación se desarrolle sin problemas. Un plan sólido de recuperación ante desastres debe evitar atajos como realizar pruebas solo una vez al año (o no realizarlas en absoluto), precargar cintas en las bibliotecas de cintas, preparar los servidores con antelación y sustituir las pruebas completas de restauración por comprobaciones aleatorias.

Consejos para mejorar las pruebas:

  • Implemente soluciones avanzadas de copia de seguridad y recuperación en la nube que realicen automáticamente pruebas completas de recuperación de su entorno de copia de seguridad.
  • Invierte en soluciones de copia de seguridad y recuperación que comprueben automáticamente la capacidad de recuperación de las aplicaciones y documenten el tiempo real de recuperación ante desastres y el punto de recuperación.

4. Falta de protección frente a la corrupción de datos y el malware

Existen innumerables causas de corrupción de los datos de copia de seguridad que pueden provocar que las recuperaciones fracasen: desde la inversión de bits provocada por erupciones solares hasta cortes de corriente inesperados, pasando por problemas con XFS y el sistema de archivos, así como diversos fallos de hardware (problemas con controladores RAID, controladores de almacenamiento, corrupción del sistema de archivos, fallos en los NAS, etc.).

A pesar de la creciente frecuencia de incidentes que acaparan los titulares, la incapacidad de detectar malware en los entornos de copia de seguridad sigue siendo uno de los problemas más habituales que provocan fallos en la recuperación ante desastres. Los creadores de ransomware se han vuelto cada vez más sofisticados: crean programas que permanecen inactivos el tiempo suficiente como para ser incluidos en las copias de seguridad de los datos, lo que impide defenderse de los ataques mediante una simple recuperación de los datos más recientes.

Consejos para evitar la corrupción de datos y la infección por malware en tus copias de seguridad:

  • Elige una tecnología de copia de seguridad y recuperación basada en Linux. La mayoría de las infecciones por malware afectan a los sistemas basados en Windows.
  • Asegúrate de que tu tecnología de copia de seguridad y recuperación sea capaz de detectar los primeros indicios de una infección por malware.
  • Utiliza una solución de copia de seguridad y recuperación que active automáticamente y compruebe la capacidad de recuperación de las aplicaciones en tu entorno de copia de seguridad, para garantizar que puedas recuperarlas de forma segura con copias de seguridad no infectadas en caso de un ataque de ransomware (u otro tipo de malware).
  • Asegúrate de que tu solución de copia de seguridad cuente con un control de redundancia cíclica (CRC) integrado. El CRC es un código de detección de errores que se utiliza para detectar cambios accidentales en los bloques de datos que se introducen en tu sistema de copia de seguridad, con el fin de garantizar que no se produzca ninguna corrupción de datos.

5. Incumplimiento de las buenas prácticas en la gestión de los medios de comunicación

Una de las razones más habituales por las que no se puede recuperar una copia de seguridad aparentemente perfecta es el manejo incorrecto de los soportes de copia de seguridad o archivo —cintas, discos duros extraíbles, etc.—. Aunque las cintas y los discos extraíbles son soportes relativamente sencillos desde el punto de vista tecnológico, su manejo es muy manual y exige un cumplimiento riguroso de las mejores prácticas. Errores humanos sencillos, como etiquetar incorrectamente una cinta o una unidad de archivo, pueden hacer imposible la recuperación a partir de estos soportes.

Para realizar copias de seguridad de datos de forma eficiente, puedes automatizar todo el proceso de gestión de copias de seguridad, replicación externa y conservación a largo plazo. También puedes optar por utilizar la recuperación ante desastres como servicio (DRaaS).

Los electrodomésticos más avanzados del mercado actual también incorporan componentes de autorreparación y sistemas de supervisión remota que detectan los primeros indicios de problemas de hardware y programan automáticamente el mantenimiento antes de que se produzca una avería real.

Las infraestructuras de TI actuales son combinaciones cada vez más complejas de entornos locales, SaaS, en la nube y virtuales. Para garantizar una copia de seguridad y una recuperación eficientes, plantéate utilizar una solución de copia de seguridad que se integre con tu solución de gestión de terminales. Supervisa y gestiona todos tus terminales, así como las implementaciones de antivirus y antimalware y las copias de seguridad, todo ello desde una única consola.

Kaseya Unified Backup reúne los mejores servicios del mundo en materia de copias de seguridad, protección contra el ransomware, almacenamiento en la nube y continuidad del negocio y recuperación ante desastres (BCDR) en una potente plataforma «todo en uno» basada en dispositivos. Para obtener más información sobre Kaseya Unified Backup, descarga aquí nuestro resumen del producto.

Una plataforma integral para la gestión de TI y seguridad

Kaseya 365 es la solución integral para gestionar, proteger y automatizar las TI. Gracias a sus integraciones fluidas en todas las funciones críticas de TI, simplifica las operaciones, refuerza la seguridad y aumenta la eficiencia.

10 datos sobre la Dark Web que debes conocer

10 datos sobre la Dark Web que debes conocer

Descargar ahora
10 datos sobre la IA y la ciberseguridad que debes conocer

10 datos sobre la IA y la ciberseguridad que debes conocer

Descargar ahora
10 datos sobre el riesgo de phishing y los comportamientos peligrosos de los empleados que no te puedes perder

10 datos sobre el riesgo de phishing y los comportamientos peligrosos de los empleados que no te puedes perder

Descargar ahora