מערך שרתים ואחסון המשמש לתוכנית התאוששות מאסון
צילום: Jakub Zerdzicki / Pexels

DR מרוחק: איך קובעים מרחק נכון מאתר הייצור

אתר Disaster Recovery צריך להגן על הארגון מאירוע שמשבית את אתר הייצור. לכן הפרדה גיאוגרפית חשובה, אך אין מספר אוניברסלי של 20 קילומטר שמתאים לכל ארגון ולכל תרחיש.

המרחק הנכון נגזר מניתוח סיכונים: אילו תקלות עלולות להשפיע על שני האתרים, אילו תשתיות משותפות להם, כמה זמן הארגון יכול להיות מושבת וכמה מידע הוא מוכן לאבד.

מרחק אינו המדד היחיד

שני אתרים יכולים להיות במרחק עשרות קילומטרים ועדיין להסתמך על אותה תחנת חשמל, אותו ספק תקשורת או אותו מסלול סיבים. מנגד, אתר בענן באזור נפרד עשוי לספק הפרדת כשל טובה יותר, בתנאי שגם הזהויות, הגיבויים והגישה הניהולית אינם תלויים בנקודת כשל אחת.

בבחירת אתר משני כדאי לבדוק:

  • האם הוא נמצא מחוץ לאותו אזור סיכון פיזי.
  • האם קיימים ספקי חשמל ותקשורת נפרדים ככל האפשר.
  • האם הגיבויים מבודדים מהרשאות סביבת הייצור ומוגנים מפני מחיקה.
  • האם ניתן להגיע למערכות גם כשהמשרד אינו נגיש.
  • האם קיבולת האתר המשני מספיקה להפעלת השירותים הקריטיים.

RTO ו־RPO קודמים לבחירת הטכנולוגיה

RTO הוא הזמן המרבי שהארגון מוכן להמתין עד לחזרת שירות. RPO הוא חלון אובדן המידע שהארגון יכול לספוג. מערכת הנהלת חשבונות, שרת קבצים ואתר תדמית אינם בהכרח זקוקים לאותם יעדים.

רפליקציה תכופה עשויה לקצר RPO, אך היא יכולה גם להעתיק מחיקה או הצפנה לאתר המשני. לכן DR אינו מחליף גיבוי מבודד ובעל היסטוריית גרסאות.

Failover מהיר אינו הבטחה אוטומטית

מעבר לאתר חלופי יכול להימשך דקות, שעות או יותר. הזמן תלוי במצב הנתונים, ביישומים, ב־DNS, בזהויות, ברישיונות, בחיבורי צד שלישי וביכולת הצוות לבצע את הנוהל. הבטחת זמן התאוששות צריכה להופיע בהסכם שירות ולהיבדק בתרגיל, ולא להסתמך רק על נתוני היצרן.

תוכנית DR שימושית כוללת סדר הפעלה, בעלי תפקידים, ערוצי תקשורת חלופיים, פרטי ספקים, תהליך חזרה לאתר הראשי וקריטריונים ברורים להכרזה על אירוע.

המבחן האמיתי הוא תרגול

בדיקה תקופתית צריכה לוודא שהמערכות עולות, שהמשתמשים יכולים להתחבר, שהיישומים מעבדים נתונים ושהגיבויים ניתנים לשחזור. יש לתעד את זמני ההתאוששות בפועל ולתקן פערים בין היעד לבין התוצאה.

ב־M-Challenge אנו ממליצים לבנות את הארכיטקטורה לפי התהליכים הקריטיים של העסק ולא לפי כלל מרחק יחיד. לעיתים הפתרון יהיה דאטה סנטר נוסף, לעיתים אזור ענן נפרד ולעיתים שילוב בין השניים.

מקור מקצועי: NIST SP 800-34 Rev. 1 – Contingency Planning Guide.

צילום: Jakub Zerdzicki / Pexels. מקור התמונה, בהתאם לרישיון Pexels.

דילוג לתוכן