הגדרת תמונות מצב שמודעות ל-Pacemaker עבור IBM Db2 HADR במסוף לניהול מכשירים

שירות Backup and DR מספק תכונת snapshot שמודעת ל-Pacemaker עבור מסדי נתונים של IBM Db2 High Availability Disaster Recovery ‏ (HADR). אפשר להשתמש בתכונה הזו כדי ליצור בבטחה תמונות מצב של דיסק מתמשך של מסד נתונים במצב המתנה שמנוהל על ידי אשכול Pacemaker.

התהליך הזה מונע מ-Pacemaker לפרש לא נכון את ההשבתה הזמנית של מסד הנתונים במהלך יצירת תמונת מצב ככשל. כך נמנעת פרשנות שגויה שעלולה להוביל להפעלה מחדש של מסד הנתונים ללא צורך.

לפני שמתחילים

נותנים למשתמש במערכת ההפעלה של מופע Db2 את ההרשאות הנדרשות להרצת פקודות Pacemaker עם הרשאות sudo בכל צמתי ההמתנה של Db2 HADR.

  1. כמשתמש root, פותחים את הקובץ /etc/sudoers.d/db2_pacemaker_access לעריכה:

    visudo -f /etc/sudoers.d/db2_pacemaker_access
    
  2. מוסיפים את השורה הבאה לקובץ:

    DB2_INSTANCE_OS_USER  ALL=(root)    NOPASSWD: /usr/sbin/pcs status, /usr/sbin/pcs resource * DB2_HADR_PACEMAKER_RESOURCE_REGEX
    
  3. מחליפים את ה-placeholders הבאים:

    • DB2_INSTANCE_OS_USER: שם המשתמש של מערכת ההפעלה של מופע Db2.
    • DB2_HADR_PACEMAKER_RESOURCE_REGEX: הביטוי הרגולרי שתואם לשם המשאב של Db2 HADR Pacemaker. לדוגמה, *_db2.

הפעלת גיבויים עם תמיכה ב-Pacemaker

כדי להפעיל את התכונה הזו, צריך לציין את שם המשאב של Pacemaker בהגדרות הגיבוי של אפליקציית Db2.

  1. במסוף הניהול של מכשיר Backup and DR, עוברים להגדרות הגיבוי של אפליקציית Db2.
  2. מאתרים את האפשרות Db2 HADR CLUSTER PACEMAKER RESOURCE.
  3. מזינים את שם המשאב של Pacemaker עבור מופע Db2 שמנהל את אשכול HADR.

איך פועלות תמונות המצב שמודעות לקוצבי לב

תהליך הגיבוי שמותאם ל-Pacemaker מתאם בין Pacemaker ל-Db2 באמצעות רצף פעולות ספציפי.

  1. הסקריפט מריץ בדיקות מקדימות כדי לוודא שהוא נמצא בצומת ההמתנה ושהצמד HADR נמצא במצב תקין.
  2. הסקריפט מעביר את משאב מופע Db2 למצב תחזוקה של Pacemaker. הפעולה הזו מורה ל-Pacemaker להפסיק את המעקב אחרי המשאב.
  3. הסקריפט משבית את מסד הנתונים באמצעות הפקודה db2 deactivate כדי להקפיא את קלט/פלט של מסד הנתונים.
  4. התסריט מצלם תמונת מצב של אחסון Persistent Disk.
  5. הסקריפט מפעיל את מסד הנתונים באמצעות הפקודה db2 activate כדי לבטל את ההקפאה של קלט/פלט.
  6. הסקריפט מסיר את משאב מופע Db2 ממצב תחזוקה, מה שמאפשר ל-Pacemaker לחדש את המעקב.
  7. הסקריפט מתעד את כל הפעולות ומריץ שגרות ניקוי.

פתרון בעיות

אם משימת גיבוי נכשלת, כדאי לבדוק את היומנים הבאים בצומת ההמתנה של מסד הנתונים כדי לקבל פרטים נוספים:

  • /var/act/log/customapp-db2instance.log: מכיל מידע על השבתה והפעלה של מסד נתונים במצב המתנה, ועל כניסה ויציאה ממצב תחזוקה של משאב Pacemaker.
  • /act/tmpdata/BACKUP_JOB_NAME/pcs_background_cleanup.log: מציין אם משאב Pacemaker הוצא אוטומטית ממצב תחזוקה כי קובץ ה-snapshot חרג מהזמן הקצוב לתפוגה של שתי דקות.
  • /var/log/pacemaker/pacemaker.log: מספק הקשר נוסף מ-Pacemaker.

זמן קצוב לתמונת מצב

אם עבודת צילום תמונת מצב של דיסק מתמשך נמשכת יותר משתי דקות, Backup and DR יוצא אוטומטית ממצב תחזוקת משאבי Pacemaker. סטטוס עבודת הגיבוי משתנה ל-Retrying, והמתזמן מתחיל גיבוי חדש תוך עשר דקות.

עבודות גיבוי שבוטלו או נחסמו

אם עבודת גיבוי מבוטלת או נחסמת, המערכת יוצאת ממצב תחזוקת משאבי Pacemaker אחרי שתי דקות, ועבודת הגיבוי נכשלת.

הגדרת התראות

אפשר להגדיר התראות ממסוף הניהול של מכשיר Backup and DR כדי לשלוח אימיילים כשמשימת גיבוי נכשלת. מומלץ גם להגדיר התראות של Pacemaker על סמך pcs status.

המאמרים הבאים