Continuidad operacional: diseñar recuperación antes del incidente

La continuidad no se compra como una sola característica. Se construye con dependencias conocidas, responsabilidades y pruebas periódicas.

Revisado por ingeniería de Grupo ZGH

Guía de decisión · Continuidad operacional

¿Cómo diseño infraestructura para continuidad operacional?

Identifica primero los procesos críticos y su impacto; luego define RPO y RTO, dependencias, responsables y escenarios de falla. Con esa base se decide qué combinar: redundancia, respaldos, sitio alternativo, conectividad, monitoreo, seguridad y procedimiento de recuperación. ZGH puede aportar infraestructura, red y operación, pero el resultado requiere acuerdos y pruebas junto al cliente.

Casos de uso

Servicios que no pueden detenerse

ERP, comercio, salud, seguridad, plataformas públicas y procesos con impacto financiero u operacional.

Dependencias concentradas

Operaciones donde energía, conectividad, hardware, personas o proveedores representan un punto único de falla.

Crecimiento sin arquitectura

Sistemas que aumentaron capacidad y complejidad sin actualizar respaldo, monitoreo o recuperación.

Criterios de decisión

Del impacto de negocio a la arquitectura

La tecnología se define después de entender qué debe recuperarse, en qué orden y con qué información.

  1. Servicios críticos

    Procesos, usuarios, horarios, impacto y orden de recuperación.

  2. RPO y RTO

    Pérdida de datos tolerable y tiempo objetivo para volver a operar.

  3. Dependencias

    Personas, proveedores, DNS, red, identidad, licencias, aplicaciones, datos y accesos.

  4. Controles

    Redundancia, backup, réplica, monitoreo, seguridad y documentación.

  5. Pruebas

    Restauraciones, simulacros, resultados, brechas y responsables de corregirlas.

Alcance explícito

Entregables de una estrategia operable

Diseñar y documentar

  • Mapa de servicios y dependencias
  • RPO y RTO por servicio
  • Arquitectura objetivo
  • Matriz de responsabilidades
  • Procedimientos de recuperación
  • Plan de pruebas y mejora

No confundir con continuidad completa

  • RAID no reemplaza backup
  • Backup sin restauración probada no demuestra recuperación
  • Alta disponibilidad local no equivale a DR geográfico
  • Monitoreo no implica respuesta autorizada
  • Una segunda conexión puede compartir riesgos físicos
  • El SLA debe coincidir con la arquitectura contratada

AS263702 · Evidencia pública

Capacidades visibles para diseñar la solución

ZGH publica infraestructura de datacenter, cloud, red, NOC y servicios de ingeniería. AS263702 entrega una identidad de red verificable para los componentes de conectividad.

FAQ

Preguntas de continuidad operacional

¿Tener RAID significa que tengo respaldo?

No. RAID ayuda frente a ciertos fallos de disco, pero no protege por sí solo frente a borrado, corrupción, malware o pérdida del sitio.

¿Un backup garantiza recuperación?

Solo una restauración probada demuestra que los datos y el procedimiento permiten recuperar el servicio dentro del objetivo.

¿Necesito un segundo datacenter?

Depende de impacto, RPO, RTO y riesgos que quieras cubrir. No todos los servicios requieren el mismo nivel de separación geográfica.

Siguiente paso

Partamos por el impacto, no por el producto

Indica servicios críticos, dependencias, pérdida de datos tolerable y tiempo máximo de recuperación. Diseñaremos alternativas y dejaremos explícitos sus límites.

Diseñar continuidad operacional