שירות Backup and DR מספק תכונת snapshot שמודעת ל-Pacemaker עבור מסדי נתונים של IBM Db2 High Availability Disaster Recovery (HADR). אפשר להשתמש בתכונה הזו כדי ליצור בבטחה תמונות מצב של דיסק מתמשך של מסד נתונים במצב המתנה שמנוהל על ידי אשכול Pacemaker.
התהליך הזה מונע מ-Pacemaker לפרש לא נכון את ההשבתה הזמנית של מסד הנתונים במהלך יצירת תמונת מצב ככשל. כך נמנעת פרשנות שגויה שעלולה להוביל להפעלה מחדש של מסד הנתונים ללא צורך.
לפני שמתחילים
נותנים למשתמש במערכת ההפעלה של מופע Db2 את ההרשאות הנדרשות להרצת פקודות Pacemaker עם הרשאות sudo בכל צמתי ההמתנה של Db2 HADR.
כמשתמש
root, פותחים את הקובץ/etc/sudoers.d/db2_pacemaker_accessלעריכה:visudo -f /etc/sudoers.d/db2_pacemaker_accessמוסיפים את השורה הבאה לקובץ:
DB2_INSTANCE_OS_USER ALL=(root) NOPASSWD: /usr/sbin/pcs status, /usr/sbin/pcs resource * DB2_HADR_PACEMAKER_RESOURCE_REGEXמחליפים את ה-placeholders הבאים:
-
DB2_INSTANCE_OS_USER: שם המשתמש של מערכת ההפעלה של מופע Db2. -
DB2_HADR_PACEMAKER_RESOURCE_REGEX: הביטוי הרגולרי שתואם לשם המשאב של Db2 HADR Pacemaker. לדוגמה,*_db2.
-
הפעלת גיבויים עם תמיכה ב-Pacemaker
כדי להפעיל את התכונה הזו, צריך לציין את שם המשאב של Pacemaker בהגדרות הגיבוי של אפליקציית Db2.
- במסוף הניהול של מכשיר Backup and DR, עוברים להגדרות הגיבוי של אפליקציית Db2.
- מאתרים את האפשרות Db2 HADR CLUSTER PACEMAKER RESOURCE.
- מזינים את שם המשאב של Pacemaker עבור מופע Db2 שמנהל את אשכול HADR.
איך פועלות תמונות המצב שמודעות לקוצבי לב
תהליך הגיבוי שמותאם ל-Pacemaker מתאם בין Pacemaker ל-Db2 באמצעות רצף פעולות ספציפי.
- הסקריפט מריץ בדיקות מקדימות כדי לוודא שהוא נמצא בצומת ההמתנה ושהצמד HADR נמצא במצב תקין.
- הסקריפט מעביר את משאב מופע Db2 למצב תחזוקה של Pacemaker. הפעולה הזו מורה ל-Pacemaker להפסיק את המעקב אחרי המשאב.
- הסקריפט משבית את מסד הנתונים באמצעות הפקודה
db2 deactivateכדי להקפיא את קלט/פלט של מסד הנתונים. - התסריט מצלם תמונת מצב של אחסון Persistent Disk.
- הסקריפט מפעיל את מסד הנתונים באמצעות הפקודה
db2 activateכדי לבטל את ההקפאה של קלט/פלט. - הסקריפט מסיר את משאב מופע Db2 ממצב תחזוקה, מה שמאפשר ל-Pacemaker לחדש את המעקב.
- הסקריפט מתעד את כל הפעולות ומריץ שגרות ניקוי.
פתרון בעיות
אם משימת גיבוי נכשלת, כדאי לבדוק את היומנים הבאים בצומת ההמתנה של מסד הנתונים כדי לקבל פרטים נוספים:
-
/var/act/log/customapp-db2instance.log: מכיל מידע על השבתה והפעלה של מסד נתונים במצב המתנה, ועל כניסה ויציאה ממצב תחזוקה של משאב Pacemaker. -
/act/tmpdata/BACKUP_JOB_NAME/pcs_background_cleanup.log: מציין אם משאב Pacemaker הוצא אוטומטית ממצב תחזוקה כי קובץ ה-snapshot חרג מהזמן הקצוב לתפוגה של שתי דקות. -
/var/log/pacemaker/pacemaker.log: מספק הקשר נוסף מ-Pacemaker.
זמן קצוב לתמונת מצב
אם עבודת צילום תמונת מצב של דיסק מתמשך נמשכת יותר משתי דקות, Backup and DR יוצא אוטומטית ממצב תחזוקת משאבי Pacemaker. סטטוס עבודת הגיבוי משתנה ל-Retrying, והמתזמן מתחיל גיבוי חדש תוך עשר דקות.
עבודות גיבוי שבוטלו או נחסמו
אם עבודת גיבוי מבוטלת או נחסמת, המערכת יוצאת ממצב תחזוקת משאבי Pacemaker אחרי שתי דקות, ועבודת הגיבוי נכשלת.
הגדרת התראות
אפשר להגדיר התראות ממסוף הניהול של מכשיר Backup and DR כדי לשלוח אימיילים כשמשימת גיבוי נכשלת. מומלץ גם להגדיר התראות של Pacemaker על סמך pcs status.
המאמרים הבאים
- מידע נוסף על מושגים שקשורים ל-Backup and DR
- מידע נוסף על גיבוי והתאוששות מאסון עבור מסדי נתונים של IBM Db2