יתירות כשל וחזרה מיתירות כשל בדיסקים אסינכרוניים

במאמר הזה מוסבר איך לבצע מעבר לגיבוי (failover) וחזרה מגיבוי (failback) של דיסקים עם שכפול אסינכרוני.

במקרה של הפסקת פעילות באזור הראשי, באחריותכם לזהות את הפסקת הפעילות ולהפעיל מחדש את עומס העבודה באמצעות הדיסקים המשניים באזור המשני. שכפול אסינכרוני לא מציע ניטור של הפסקות זמניות. כדי לזהות הפסקת שירות, אפשר להשתמש במדדי RPO, בבדיקות תקינות ובמדדים ספציפיים לאפליקציה, או לפנות ל-Cloud Customer Care.

אחרי מעבר לגיבוי חם מהאזור הראשי לאזור המשני, האזור המשני הופך לאזור הראשי הפעיל.

אחרי שההשבתה או האסון נפתרים, אפשר להפעיל מעבר חזרה כדי להתחיל שכפול מהאזור המשני המקורי (האזור הראשי הפעיל) לאזור הראשי המקורי. אפשר לחזור על התהליך כדי להעביר את עומס העבודה בחזרה לאזור הראשי המקורי. העברת עומס העבודה חזרה לאזור הראשי המקורי לא הכרחית, אבל אפשר לעשות זאת בהתאם לדרישות של תוכנית התאוששות מאסון (DR), כמו מיקום או משאבים זמינים.

מידע נוסף על יתירות כשל ועל חזרה מגיבוי זמין במאמר מידע על רפליקציה אסינכרונית.

מעבר אוטומטי לאזור המשני

כשמזהים שהתרחש אסון, מתחילים בהעברה אוטומטית לגיבוי לאזור המשני. במעבר לגיבוי, עומס העבודה מועבר מהאזור הראשי לאזור המשני. אחרי המעבר לגיבוי, הדיסק המשני הוא הדיסק הראשי הפעיל והאזור המשני הוא האזור הראשי הפעיל.

אפשר לבצע מעבר לגיבוי חלופי בדיסק יחיד או בכל הדיסקים בקבוצת עקביות.

דיסק יחיד

כדי לבצע מעבר לגיבוי במקרה של כשל בדיסק יחיד:

  1. הפסקת השכפול של הדיסק.
  2. אם עדיין אין לכם מכונה וירטואלית באותו אזור שבו נמצא הדיסק המשני, צריך ליצור אחת.
  3. מצרפים את הדיסק המשני למכונה הווירטואלית:

    הדיסק המשני הוא עכשיו הדיסק הראשי הפעיל של עומס העבודה, והאזור המשני הוא האזור הראשי הפעיל.

קבוצת עקביות

כדי לבצע יתירות כשל בקבוצת אפליקציות עקביות, בצע את הפעולות הבאות:

  1. הפסקת השכפול של קבוצת האפליקציות העקביות.
  2. אם עדיין אין לכם מכונות וירטואליות באותו אזור כמו הדיסקים המשניים, צריך ליצור אותן.
  3. מצרפים את הדיסקים המשניים למכונות הווירטואליות:

חזרה אוטומטית לאזור הראשי המקורי

אחרי שהבעיה נפתרה, מתחילים בהעברה חזרה לאזור הראשי המקורי. במקרה של מעבר חזרה, המערכת מגדירה ומתחילה שכפול מהדיסק הראשי הפעיל לדיסק משני חדש באזור המשני הפעיל.

אפשר לבצע מעבר חזרה לדיסק יחיד או לכל הדיסקים בקבוצת אפליקציות עקביות.

דיסק יחיד

כדי לבצע מעבר חזרה לדיסק יחיד:

  1. יוצרים דיסק משני באזור המשני הפעיל. האזור המשני הפעיל הוא האזור הראשי המקורי.
  2. מתחילים שכפול מהדיסק הראשי הפעיל לדיסק המשני החדש.
  3. אופציונלי: מעבירים את עומס העבודה מהאזור הראשי הפעיל לאזור הראשי המקורי באופן הבא:

    1. ממתינים עד שהשכפול הראשוני יסתיים. השכפול הראשוני מסתיים כשמדד disk/async_replication/time_since_last_replication זמין ב-Cloud Monitoring. אם מדד ה-RPO לא מופיע ב-Cloud Explorer, המשמעות היא שהשכפול הראשוני לא הושלם.
    2. מומלץ: כדי למנוע אובדן נתונים, כדאי לתזמן השבתה של עומס העבודה ולהעביר אותו למצב אופליין.
    3. הפסקת הרפליקציה.
    4. מחברים את הדיסק המשני ל-VM:

      הדיסק המשני הוא עכשיו הדיסק הראשי של עומס העבודה באזור הראשי המקורי.

    5. מגדירים מחדש את הרפליקציה באזור הראשי המקורי באופן הבא:

      1. יוצרים דיסק משני חדש באזור המשני המקורי.
      2. מתחילים שכפול מהדיסק הראשי לדיסק המשני החדש.

קבוצת עקביות

כדי לבצע מעבר חזרה (failback) של קבוצת עקביות:

  1. יוצרים קבוצת אפליקציות עקביות חדשה באזור הראשי הפעיל. האזור הראשי בפועל הוא האזור המשני המקורי.
  2. הוספת הדיסקים הראשיים הפעילים לקבוצת העקביות
  3. יוצרים דיסקים משניים באזור המשני הפעיל שמפנים לדיסקים הראשיים הפעילים.
  4. מתחילים את השכפול.
  5. אופציונלי: מעבירים את עומס העבודה מהאזור הראשי הפעיל לאזור הראשי המקורי באופן הבא:

    1. ממתינים עד שהשכפול הראשוני יסתיים. השכפול הראשוני מסתיים כשמדד ה-RPO זמין. אם מדד ה-RPO לא מופיע ב-Cloud Explorer, המשמעות היא שהשכפול הראשוני לא הושלם.
    2. מומלץ: כדי למנוע אובדן נתונים, כדאי לתזמן השבתה של עומס העבודה ולהעביר אותו למצב אופליין.
    3. הפסקת הרפליקציה.
    4. מחברים את הדיסק המשני למכונות וירטואליות:

      הדיסקים המשניים הם עכשיו הדיסקים הראשיים של עומס העבודה באזור הראשי המקורי.

    5. מגדירים מחדש את הרפליקציה באזור הראשי המקורי באופן הבא:

      1. מוסיפים את הדיסקים הראשיים לקבוצת העקביות המקורית.
      2. יוצרים דיסקים משניים חדשים באזור המשני המקורי.
      3. מתחילים את השכפול.

המאמרים הבאים