ניהול התשתית ב-Google Cloud ומעקב אחריה

Last reviewed 2024-11-20 UTC

אחרי שפורסים אפליקציה בסביבת ייצור ב- Google Cloud, יכול להיות שיהיה צורך לשנות את התשתית שבה היא משתמשת. לדוגמה, יכול להיות שתצטרכו לשנות את סוגי המכונות של המכונות הווירטואליות או לשנות את סוג האחסון של הקטגוריות ב-Cloud Storage. בחלק הזה של Google Cloud מדריך האמינות של התשתית מופיע סיכום של הנחיות לניהול שינויים, שאפשר לפעול לפיהן כדי להפחית את הסיכון לאמינות של משאבי התשתית. בנוסף, בחלק הזה מוסבר איך אפשר לעקוב אחרי הזמינות של תשתית Google Cloud .

פריסת שינויים בתשתית באופן הדרגתי

כשצריך לשנות את התשתית, מומלץ לפרוס את השינויים בסביבת הייצור באופן הדרגתי. לדוגמה, אם צריך לשנות את סוגי המכונות של המכונות הווירטואליות, כדאי לפרוס את השינויים בכמה מכונות וירטואליות באזור אחד ולעקוב אחרי ההשפעות של השינויים. אם מזהים בעיות, צריך להחזיר את התשתית במהירות למצב היציב הקודם, לאבחן את הבעיות ולפתור אותן, ואז להפעיל מחדש את תהליך הפריסה ההדרגתית. אחרי שמוודאים שעומס העבודה פועל כמצופה, אפשר לפרוס את השינויים בהדרגה בכל התשתית. Google Cloud

שליטה בשינויים במשאבים גלובליים

כשמשנים משאבים גלובליים כמו רשתות VPC ומאזני עומסים גלובליים, חשוב במיוחד לוודא את השינויים לפני שמפעילים אותם בסביבת הייצור.

משאבים גלובליים עמידים להפסקות שירות באזורים ובתחומים (zones), ולכן יכול להיות שתחליטו להשתמש במופעים יחידים של משאבים גלובליים מסוימים בארכיטקטורה שלכם. בפריסות כאלה, המשאבים הגלובליים יכולים להפוך לנקודות כשל יחידות. לדוגמה, אם בטעות הגדרתם כלל העברה שגוי במאזן עומסים גלובלי, יכול להיות שהקצה הקדמי יפסיק לקבל או לעבד בקשות של משתמשים. בפועל, האפליקציה לא זמינה למשתמשים במקרה הזה, למרות שהקצה העורפי תקין. כדי להימנע ממצבים כאלה, חשוב להקפיד על בקרה קפדנית של שינויים במשאבים גלובליים. לדוגמה, בתהליך בדיקת השינויים, אפשר לסווג שינויים במשאבים גלובליים כשינויים בסיכון גבוה שצריכים לעבור אימות ואישור של בודקים נוספים.

מעקב אחר הזמינות של תשתית Google Cloud

אתם יכולים לעקוב אחרי הסטטוס הנוכחי של השירותים בכל האזורים באמצעות Google Cloud לוח הבקרה של Service Health. אתם יכולים גם לראות היסטוריה של כשלים בתשתית (שנקראים אירועים) לכל שירות. בדף ההיסטוריה מופיעים פרטים על כל אירוע, כמו משך האירוע, האזורים והאזורים המושפעים, השירותים המושפעים ופתרונות עקיפים מומלצים. Google Cloud

אתם יכולים גם להשתמש ב-Service Health בהתאמה אישית כדי לראות אירועים שרלוונטיים לפרויקט שלכם. בנוסף, אתם יכולים להשתמש ב-Service Health כדי לשלוח בקשה לקבלת מידע על אירועים באמצעות API על בסיס פרויקט או ארגון, וגם להגדיר התראות.

‫Google מספקת עדכונים שוטפים לגבי הסטטוס של כל אירוע, כולל הערכה לגבי הזמן שבו יתקבל העדכון הבא. אפשר לקבל עדכונים לגבי הסטטוס של אירועים באופן אוטומטי באמצעות פיד RSS. למידע נוסף, ראו אירועים ולוח הבקרה של Service Health. Google Cloud

Google Cloud