יצירת מכונה וירטואלית שעברה אופטימיזציה באמצעות AI עם A3 Edge

במאמר הזה מתוארים השלבים ליצירת מכונות וירטואליות (VM) עצמאיות שמשתמשות בסוגי מכונות שעברו אופטימיזציה למאיץ A3 Edge. מידע נוסף על סוגי המכונות זמין במאמר A3 Edge.

מידע על דרכים נוספות ליצירת מכונות וירטואליות או אשכולות זמין בדף סקירה כללית.

מגבלות

כשיוצרים מכונת VM עצמאית של A3 Edge, חלות המגבלות הבאות:

אם רוצים להשתמש במדיניות מיקום קומפקטית, צריך לעיין בהגבלות על מדיניות מיקום.

לפני שמתחילים

לפני שיוצרים מכונות וירטואליות, אם עדיין לא עשיתם זאת, צריך לבצע את השלבים הבאים:

  1. בחירת אפשרות צריכה: האפשרות שתבחרו לצריכה תקבע איך תקבלו משאבי GPU ותשתמשו בהם. מידע נוסף זמין במאמר בנושא בחירת אפשרות צריכה.
  2. קבלת קיבולת: התהליך לקבלת קיבולת שונה לכל אפשרות צריכה. כדי לקבל מידע על התהליך להשגת קיבולת לאפשרות הצריכה שבחרתם, אפשר לעיין במאמר סקירה כללית על קיבולת.

צריך לבחור את הכרטיסייה הרלוונטית לאופן שבו תכננתם להשתמש בדוגמאות בדף הזה:

המסוף

כשמשתמשים במסוף Google Cloud כדי לגשת לשירותים ולממשקי ה-API, לא צריך להגדיר אימות. Google Cloud

gcloud

במסוף Google Cloud , מפעילים את Cloud Shell.

הפעלת Cloud Shell

בחלק התחתון של Google Cloud המסוף יתחיל סשן של Cloud Shell ותופיע הודעה של שורת הפקודה. Cloud Shell היא סביבת מעטפת שבה ה-CLI של Google Cloud מותקן ומוגדרים ערכים לפרויקט הקיים. הסשן יופעל תוך כמה שניות.

REST

כדי להשתמש בסביבת פיתוח מקומית בדוגמאות של API בארכיטקטורת REST שבדף הזה, צריך להשתמש בפרטי הכניסה שאתם נותנים ל-CLI של gcloud.

    התקינו את ה-CLI של Google Cloud.

    אם אתם משתמשים בספק זהויות חיצוני (IdP), קודם אתם צריכים להיכנס ל-CLI של gcloud באמצעות המאגר המאוחד לניהול זהויות.

מידע נוסף מופיע במאמר אימות לשימוש ב-REST במסמכי האימות של Google Cloud .

התפקידים הנדרשים

כדי לקבל את ההרשאות שנדרשות ליצירת מכונות וירטואליות, צריך לבקש מהאדמין להקצות לכם ב-IAM את התפקיד אדמין מכונות של Compute ‏ (v1) (roles/compute.instanceAdmin.v1) בפרויקט. כדי לקרוא הסבר על מתן תפקידים, ראו איך מנהלים את הגישה ברמת הפרויקט, התיקייה והארגון.

זהו תפקיד שמוגדר מראש וכולל את ההרשאות שנדרשות ליצירת מכונות וירטואליות. כדי לראות בדיוק אילו הרשאות נדרשות, אפשר להרחיב את הקטע ההרשאות הנדרשות:

ההרשאות הנדרשות

כדי ליצור מכונות וירטואליות, צריך את ההרשאות הבאות:

  • compute.instances.create בפרויקט
  • כדי להשתמש באימג' בהתאמה אישית ליצירת המכונה הווירטואלית (VM)‏: ‫compute.images.useReadOnly בקובץ אימג'
  • כדי להשתמש ב-snapshot ליצירת המכונה הווירטואלית: ‫compute.snapshots.useReadOnly בקובץ snapshot
  • כדי להשתמש בתבנית של הגדרות מכונה ליצירת המכונה הווירטואלית: compute.instanceTemplates.useReadOnly בתבנית של הגדרות המכונה
  • כדי לציין רשת משנה למכונה הווירטואלית: ‫compute.subnetworks.use בפרויקט או ברשת המשנה שנבחרה
  • כדי לציין כתובת IP סטטית למכונה הווירטואלית: ‫compute.addresses.use בפרויקט
  • כדי להקצות כתובת IP חיצונית למכונה הווירטואלית כשמשתמשים ברשת VPC: ‫compute.subnetworks.useExternalIp בפרויקט או ברשת המשנה שנבחרה
  • כדי להקצות רשת מדור קודם למכונה הווירטואלית: ‫compute.networks.use בפרויקט
  • כדי להקצות כתובת IP חיצונית למכונה הווירטואלית כשמשתמשים ברשת מדור קודם: ‫compute.networks.useExternalIp בפרויקט
  • כדי להגדיר מטא-נתונים של המכונה הווירטואלית: ‫compute.instances.setMetadata בפרויקט
  • כדי להגדיר תגים למכונה הווירטואלית: ‫compute.instances.setTags במכונה הווירטואלית
  • כדי להגדיר תוויות למכונה הווירטואלית: ‫compute.instances.setLabels במכונה הווירטואלית
  • כדי להגדיר חשבון שירות לשימוש של המכונה הווירטואלית: ‫compute.instances.setServiceAccount במכונה הווירטואלית
  • כדי ליצור דיסק חדש למכונה הווירטואלית: ‫compute.disks.create בפרויקט
  • כדי לצרף דיסק קיים במצב קריאה-בלבד או במצב קריאה וכתיבה: ‫compute.disks.use בדיסק
  • כדי לצרף דיסק קיים במצב קריאה-בלבד: ‫compute.disks.useReadOnly בדיסק

יכול להיות שתקבלו את ההרשאות האלה באמצעות תפקידים בהתאמה אישית או תפקידים מוגדרים מראש אחרים.

סקירה כללית

יצירת מכונה עם סוג המכונה A3 Edge כוללת את השלבים הבאים:

  1. יצירת רשתות VPC
  2. אופציונלי: יצירת מדיניות למיקום קומפקטי
  3. יצירת מופע
  4. התקנת דרייברים של GPU
  5. אופציונלי: הפעלת מצב NVIDIA Multi-Instance GPU

יצירת רשתות VPC

כדי לאפשר תקשורת יעילה בין מכונות וירטואליות של GPU, צריך ליצור רשת ניהול ורשת נתונים אחת או יותר. הרשת לניהול משמשת לגישה חיצונית, למשל SSH, ולרוב התקשורת הכללית ברשת. רשתות הנתונים משמשות לתקשורת עם ביצועים גבוהים בין מעבדי ה-GPU במכונות וירטואליות שונות, למשל לתנועת נתונים של Remote Direct Memory Access ‏ (RDMA).

ברשתות VPC האלה, מומלץ להגדיר ערך גדול יותר ליחידת השידור המקסימלית (MTU). ערכי MTU גבוהים יותר מגדילים את גודל החבילה ומפחיתים את התקורה של כותרת החבילה, וכך מגדילים את קצב העברת הנתונים של המטען הייעודי. מידע נוסף על יצירת רשתות VPC זמין במאמר יצירה ואימות של רשת MTU עם מסגרת ג'מבו.

יצירת רשת ניהול, רשת משנה וכלל לחומת האש

כדי להגדיר את רשת הניהול:

  1. יוצרים את רשת הניהול באמצעות הפקודה networks create:

    gcloud compute networks create NETWORK_NAME_PREFIX-mgmt-net \
        --project=PROJECT_ID \
        --subnet-mode=custom \
        --mtu=8244
    
  2. יוצרים את רשת המשנה לניהול באמצעות הפקודה networks subnets create:

    gcloud compute networks subnets create NETWORK_NAME_PREFIX-mgmt-sub \
        --project=PROJECT_ID \
        --network=NETWORK_NAME_PREFIX-mgmt-net \
        --region=REGION \
        --range=192.168.0.0/24
    
  3. יוצרים כללים לחומת האש באמצעות הפקודה firewall-rules create.

    1. יוצרים כלל לחומת האש עבור רשת הניהול.

      gcloud compute firewall-rules create NETWORK_NAME_PREFIX-mgmt-internal \
          --project=PROJECT_ID \
          --network=NETWORK_NAME_PREFIX-mgmt-net \
          --action=ALLOW \
          --rules=tcp:0-65535,udp:0-65535,icmp \
          --source-ranges=192.168.0.0/16
      
    2. יוצרים את כלל חומת האש tcp:22 כדי להגביל את כתובות ה-IP של המקור שיכולות להתחבר למכונה הווירטואלית באמצעות SSH.

      gcloud compute firewall-rules create NETWORK_NAME_PREFIX-mgmt-external-ssh \
          --project=PROJECT_ID \
          --network=NETWORK_NAME_PREFIX-mgmt-net \
          --action=ALLOW \
          --rules=tcp:22 \
          --source-ranges=SSH_SOURCE_IP_RANGE
      
    3. יוצרים את כלל חומת האש icmp שאפשר להשתמש בו כדי לבדוק אם יש בעיות בהעברת נתונים ברשת.

      gcloud compute firewall-rules create NETWORK_NAME_PREFIX-mgmt-external-ping \
          --project=PROJECT_ID \
          --network=NETWORK_NAME_PREFIX-mgmt-net \
          --action=ALLOW \
          --rules=icmp \
          --source-ranges=0.0.0.0/0
      

מחליפים את מה שכתוב בשדות הבאים:

  • NETWORK_NAME_PREFIX: תחילית השם שתשמש לרשתות ולרשתות המשנה של ה-VPC.
  • PROJECT_ID : מזהה הפרויקט.
  • REGION: האזור שבו רוצים ליצור את הרשתות.
  • SSH_SOURCE_IP_RANGE: טווח כתובות IP בפורמט CIDR. ההגדרה הזו מציינת אילו כתובות IP של מקור יכולות להתחבר למכונה הווירטואלית באמצעות SSH.

יצירת רשתות נתונים, רשתות משנה וכלל לחומת האש

ב-A3 Edge נדרשות ארבע רשתות נתונים. כדי ליצור ארבע רשתות נתונים, שלכל אחת מהן יש רשתות משנה וכללי חומת אש, משתמשים בפקודה הבאה.

for N in $(seq 1 4); do
gcloud compute networks create NETWORK_NAME_PREFIX-data-net-$N \
    --project=PROJECT_ID \
    --subnet-mode=custom \
    --mtu=8244

gcloud compute networks subnets create NETWORK_NAME_PREFIX-data-sub-$N \
    --project=PROJECT_ID \
    --network=NETWORK_NAME_PREFIX-data-net-$N \
    --region=REGION \
    --range=192.168.$N.0/24

gcloud compute firewall-rules create NETWORK_NAME_PREFIX-data-internal-$N \
    --project=PROJECT_ID \
    --network=NETWORK_NAME_PREFIX-data-net-$N \
    --action=ALLOW \
    --rules=tcp:0-65535,udp:0-65535,icmp \
    --source-ranges=192.168.0.0/16
done

אופציונלי: יצירת מדיניות למיקום קומפקטי

אתם יכולים להגדיר את מיקום מכונת ה-VM על ידי יצירת מדיניות למיקום קומפקטי. כשמחילים מדיניות מיקום קומפקטית על מכונות וירטואליות, מערכת Compute Engine מנסה ככל האפשר ליצור מכונות וירטואליות שקרובות זו לזו. אם האפליקציה שלכם רגישה לזמן אחזור ונדרשת בה דחיסה מקסימלית, אתם צריכים לציין את השדה maxDistance (תצוגה מקדימה) כשאתם יוצרים מדיניות למיקום קומפקטי. ערך נמוך יותר של maxDistance מבטיח מיקום קרוב יותר של מכונות וירטואליות, אבל גם מגדיל את הסיכוי שחלק מהמכונות הווירטואליות לא ייווצרו.

כדי ליצור מדיניות מיקום קומפקטית, בוחרים באחת מהאפשרויות הבאות:

gcloud

כדי ליצור מדיניות למיקום קומפקטי, משתמשים בפקודה gcloud beta compute resource-policies create group-placement:

gcloud beta compute resource-policies create group-placement POLICY_NAME \
    --collocation=collocated \
    --max-distance=MAX_DISTANCE \
    --region=REGION

מחליפים את מה שכתוב בשדות הבאים:

  • POLICY_NAME: השם של מדיניות המיקום הקומפקטי.
  • MAX_DISTANCE: הגדרת המרחק המקסימלי למכונות ה-VM. אפשר לציין את המרחק (תצוגה מקדימה, מומלץ) או לא לציין אותו (מסירים את הדגל --max-distance). בהתאם למה שסוג המכונה תומך בו, אפשר לציין אחד מהערכים הבאים:
    • כדי למקם מכונות וירטואליות באותו תת-בלוק: 1
    • כדי למקם מכונות וירטואליות באותו בלוק: 2
    • כדי למקם מכונות וירטואליות בבלוקים סמוכים: 3
    מוודאים שההגדרה של המרחק המקסימלי תומכת בסדרת המכונות ובמספר המכונות הווירטואליות שאתם מתכננים ליצור. מידע נוסף זמין במאמר מידע על מדיניות מיקום קומפקטית במאמרי העזרה של Compute Engine.
  • REGION: האזור שבו רוצים ליצור את מדיניות המיקום הקומפקטי. מציינים את האזור שמכיל את התחום שבו מתכננים ליצור מכונות, ומוודאים שסוג המכונה שרוצים להשתמש בו זמין באזור הזה. מידע על אזורים זמין במאמר זמינות של GPU לפי אזורים ותחומים.

REST

כדי ליצור מדיניות מיקום קומפקטית, שולחים בקשת POST אל ה-method‏ resourcePolicies.insert. בגוף הבקשה, כוללים את השדה collocation עם הערך COLLOCATED ואת השדה maxDistance.

POST https://compute.googleapis.com/compute/beta/projects/PROJECT_ID/regions/REGION/resourcePolicies
  {
    "name": "POLICY_NAME",
    "groupPlacementPolicy": {
      "collocation": "COLLOCATED",
      "maxDistance": MAX_DISTANCE
    }
  }

מחליפים את מה שכתוב בשדות הבאים:

  • PROJECT_ID: מזהה הפרויקט.
  • POLICY_NAME: השם של מדיניות המיקום הקומפקטי.
  • MAX_DISTANCE: הגדרת המרחק המקסימלי למכונות ה-VM. אפשר לציין את המרחק (בגרסת Preview, מומלץ) או לא לציין אותו (מסירים את השדה maxDistance). בהתאם למה שסוג המכונה תומך בו, אפשר לציין אחד מהערכים הבאים:
    • כדי למקם מכונות וירטואליות באותו תת-בלוק: 1
    • כדי למקם מכונות וירטואליות באותו בלוק: 2
    • כדי למקם מכונות וירטואליות בבלוקים סמוכים: 3
    מוודאים שההגדרה של המרחק המקסימלי תומכת בסדרת המכונות ובמספר המכונות הווירטואליות שאתם מתכננים ליצור. מידע נוסף זמין במאמר מידע על מדיניות מיקום קומפקטית במאמרי העזרה של Compute Engine.
  • REGION: האזור שבו רוצים ליצור את מדיניות המיקום הקומפקטי. מציינים את האזור שמכיל את התחום שבו מתכננים ליצור מכונות, ומוודאים שסוג המכונה שרוצים להשתמש בו זמין באזור הזה. מידע על אזורים זמין במאמר זמינות של GPU לפי אזורים ותחומים.

יצירת מכונה וירטואלית מסוג A3 Edge

כדי ליצור מכונת VM מסוג A3 Edge, משתמשים באחת מהשיטות הבאות.

הפקודות הבאות מגדירות גם את היקף הגישה של המופעים. כדי לפשט את ניהול ההרשאות, Google ממליצה להגדיר את היקף הגישה במופע לגישת cloud-platform ואז להשתמש בתפקידי IAM כדי להגדיר לאילו שירותים המופע יכול לגשת. מידע נוסף זמין במאמר בנושא שיטות מומלצות לשימוש בהיקפים.

המסוף

  1. נכנסים לדף Create an instance במסוף Google Cloud .

    כניסה לדף Create an instance

  2. מציינים שם למכונה הווירטואלית. מוסכמות למתן שמות למשאבים

  3. בוחרים את האזור והתחום שבהם רוצים ליצור מכונה וירטואלית. כאן אפשר לראות את רשימת האזורים והאזורים הזמינים של GPU.

  4. לוחצים על הכרטיסייה GPUs ומבצעים את השלבים הבאים:

    1. ברשימה GPU type, בוחרים באפשרות NVIDIA H100 80GB.
    2. ברשימה Number of GPUs בוחרים באפשרות 8.
    3. ברשימה Machine type (סוג המכונה), בוחרים באפשרות a3-edgegpu-8g.
  5. בוחרים באחת מהאפשרויות הבאות בהתאם לאפשרות הצריכה שרוצים להשתמש בה, ופועלים לפי השלבים.

    הזמנה

    מופעי A3 Edge תומכים בסוגי ההזמנות הבאים:

    • הזמנות על פי דרישה
    • הזמנות רגילות לעתיד

    כדי להשתמש בסוגי ההזמנות האלה, צריך להשתמש במודל הקצאת המשאבים הרגיל. לדוגמה, משתמשים בפרמטרים הבאים ליצירה.

    1. בקטע Provisioning model, ברשימה VM provisioning model, בוחרים באפשרות Standard. (האפשרות הזו מסומנת כברירת מחדל).
    2. כדי להגדיר באילו הזמנות המכונה הווירטואלית הזו משתמשת, מבצעים את השלבים הבאים:

      1. בתפריט הניווט, לוחצים על מתקדם.
      2. בקטע הזמנות, בוחרים אחת מהאפשרויות הבאות:

        • כדי להשתמש בקיבולת של בקשה לשמירת מקום, מסמנים את האפשרות Use automatic selection. (האפשרות הזו מסומנת כברירת מחדל).

          המופע מנסה להשתמש בקיבולת ממקום שמור שנעשה בו שימוש אוטומטי, וזה קורה רק אם יש קיבולת תואמת במקום השמור. אחרת, המכונה משתמשת בקיבולת על פי דרישה.

        • כדי לדרוש קיבולת בהזמנה, בוחרים באפשרות בחירת הזמנה ואז לוחצים על בחירת הזמנה כדי לציין באיזו הזמנה להשתמש.

          המכונה צריכה להשתמש בקיבולת ממקום שמור שמטורגט באופן ספציפי, ואסור לה להשתמש בקיבולת על פי דרישה. אם הקיבולת של ההזמנה לא זמינה, יצירת המופע תיכשל.

    על פי דרישה

    1. בקטע Provisioning model, ברשימה VM provisioning model, בוחרים באפשרות Standard. (האפשרות הזו מסומנת כברירת מחדל).
    2. אופציונלי: כדי להגדיר אם מכונת ה-VM הזו משתמשת בהזמנות, מבצעים את השלבים הבאים:

      1. בתפריט הניווט, לוחצים על מתקדם.
      2. בקטע הזמנות, בוחרים באחת מהאפשרויות הבאות:

        • כדי להשתמש בקיבולת של בקשה לשמירת מקום, מסמנים את האפשרות Use automatic selection. (זוהי אפשרות ברירת המחדל).

          המופע מנסה להשתמש בקיבולת ממקום שמור שנעשה בו שימוש אוטומטי, וזה קורה רק אם יש קיבולת תואמת במקום השמור. אחרת, המכונה משתמשת בקיבולת לפי דרישה.

        • כדי לדרוש קיבולת על פי דרישה, בוחרים באפשרות לא להשתמש בהזמנה.

          למכונה אין אפשרות להשתמש בקיבולת של אף הזמנה.

    Flex-start

    1. בקטע Provisioning model, ברשימה VM provisioning model, בוחרים באפשרות Flex-start.
    2. בשדה Enter number of hours מזינים את משך הזמן המקסימלי שבו רוצים שהמכונה הווירטואלית תפעל. הערך צריך להיות בין 46 שניות (0.01) לבין שבעה ימים (168, או 168 שעות).

    3. בוחרים באפשרות Set a wait time for VM creation (הגדרת זמן המתנה ליצירת מכונה וירטואלית).

      בהתאם לדרישות האזוריות של עומס העבודה, מציינים את אחד משני משכי הזמן הבאים כדי להגדיל את הסיכויים שהבקשה ליצירת מכונה וירטואלית תצליח:

      • עומסי עבודה עם דרישות אזוריות מחמירות: אם עומס העבודה מחייב אתכם ליצור את המכונה הווירטואלית באזור ספציפי, עליכם לציין משך זמן בין 90 שניות לבין שעתיים. ככל שהמשך ארוך יותר, כך גדל הסיכוי להשיג משאבים.
      • עומסי עבודה ללא דרישות מחמירות לגבי תחום הזמינות: אם המכונה הווירטואלית יכולה לפעול בכל תחום זמינות באזור, צריך לציין משך של 0 שניות או לבטל את הסימון של התיבה הגדרת זמן המתנה ליצירת מכונה וירטואלית. הפעולה הזו מציינת ש-Compute Engine יקצה משאבים רק אם הם זמינים באופן מיידי. אם הבקשה ליצירת מכונה וירטואלית נכשלת כי המשאבים לא זמינים, צריך לנסות שוב את הבקשה באזור אחר.

    4. בשדה On VM termination, בוחרים אם להפסיק או למחוק את המכונה הווירטואלית בסיום משך ההפעלה שלה:

      • כדי למחוק את המכונה הווירטואלית, לוחצים על מחיקה.
      • כדי לעצור את מכונת ה-VM, בוחרים באפשרות עצירה.

    Spot

    1. בקטע Provisioning model בוחרים באפשרות Spot מהרשימה VM provisioning model.
    2. אופציונלי: כדי לבחור את פעולת הסיום שמתבצעת כש-Compute Engine מבצעת דחיקה של מכונת ה-VM, מבצעים את השלבים הבאים:

      1. מרחיבים את הקטע VM provisioning model advanced settings.
      2. ברשימה On VM termination בוחרים באחת מהאפשרויות הבאות:
        • כדי לעצור את המכונה הווירטואלית במהלך הפסקת הפעולה לפני הזמן, בוחרים באפשרות Stop (ברירת מחדל).
        • כדי למחוק את המכונה הווירטואלית במהלך ההפסקה לפני הזמן, בוחרים באפשרות מחיקה.
  6. בתפריט הניווט, לוחצים על OS and storage (מערכת הפעלה ואחסון) ומבצעים את השלבים הבאים:

    1. לוחצים על Change. נפתחת החלונית Boot disk configuration (הגדרת דיסק האתחול).
    2. בכרטיסייה תמונות ציבוריות, בוחרים תמונה מומלצת. רשימה של תמונות מומלצות זמינה במאמר בנושא מערכות הפעלה.

    3. אופציונלי: כדי להגדיר את הגודל של דיסק האתחול, אפשר לעיין במאמר מגבלות הגודל של Google Cloud Hyperdisk או במאמר מגבלות הגודל של Persistent Disk, בהתאם לסוג הדיסק.

    4. כדי לאשר את האפשרויות של דיסק האתחול, לוחצים על בחירה.

  7. מגדירים את חשבון השירות ואת היקפי הגישה באופן הבא. עומסי עבודה שפועלים במופע משתמשים בחשבון השירות המצורף כדי לאשר בקשות לשירותים אחרים Google Cloud .

    1. בתפריט הניווט, לוחצים על אבטחה.
    2. ברשימה Service account בוחרים את חשבון השירות שרוצים להשתמש בו.
    3. בקטע Access scopes (היקפי גישה), בוחרים באפשרות Allow full access to all Cloud APIs (מתן גישה מלאה לכל ממשקי ה-API של Cloud). השיטה המומלצת הזו מאפשרת לכם לנהל את הגישה על ידי הוספה או הסרה של תפקידי IAM מחשבון השירות. מידע נוסף מופיע במאמר צירוף חשבון שירות למופע.
  8. כדי ליצור מכונה וירטואלית עם כמה כרטיסי NIC, מבצעים את השלבים הבאים. אחרת, כדי ליצור מכונה וירטואלית עם כרטיס רשת יחיד, מדלגים על השלבים האלה.

    1. בתפריט הניווט, לוחצים על Networking (רשת).

    2. בקטע Network interfaces (ממשקי רשת), מבצעים את הפעולות הבאות:

      1. מוחקים את ממשק הרשת שמוגדר כברירת מחדל. כדי למחוק את הממשק, לוחצים על מחיקה.
      2. לוחצים על הוספת ממשק רשת. משתמשים באפשרות הזו כדי להוסיף ממשקי רשת שמצורפים לרשתות ה-VPC שיצרתם בקטע הקודם. כשמוסיפים את ממשקי הרשת, חשוב לזכור את הנקודות הבאות:
        • לממשק רשת שמשמש לתקשורת בין מארחים, בוחרים רשת VPC רגילה ורשת משנה מהרשימות רשת ורשת משנה, ומגדירים את הרשימה כרטיס ממשק רשת לערך gVNIC. לכל רשת, חוץ מהרשת הראשונה, מגדירים את הרשימה כתובת IP חיצונית לערך None.
        • אם משתמשים בממשק רשת לתקשורת בין GPU ל-GPU באמצעות GPUDirect-TCPX, צריך לבחור את רשתות ה-VPC ותתי הרשתות המיוחדות המתאימות לכל ממשק, ולהגדיר את הרשימה כרטיס רשת ל-gVNIC גם לממשקי הרשת האלה. לכל רשת, חוץ מהרשת הראשונה, מגדירים את הרשימה כתובת IP חיצונית לערך None.
  9. כדי ליצור את המכונה הווירטואלית ולהפעיל אותה, לוחצים על Create.

gcloud

כדי ליצור את המכונה הווירטואלית, משתמשים בפקודה gcloud compute instances create.

הפרמטרים שצריך לציין תלויים באפשרות הצריכה שבה אתם משתמשים לפריסה הזו. בוחרים את הכרטיסייה שמתאימה לאפשרות הצריכה שלכם.

הזמנה

מופעי A3 Edge תומכים בסוגי ההזמנות הבאים:

  • הזמנות על פי דרישה
  • הזמנות רגילות לעתיד

כדי להשתמש בסוגי ההזמנות האלה, צריך להשתמש במודל הקצאת המשאבים הרגיל. לדוגמה, משתמשים בפרמטרים הבאים ליצירה.

לפני שמריצים את הפקודה, בודקים את כל השלבים הבאים כדי להחליט אם לכלול דגלים נוספים.

gcloud compute instances create INSTANCE_NAME  \
    --machine-type=MACHINE_TYPE \
    --image-family=IMAGE_FAMILY \
    --image-project=IMAGE_PROJECT \
    --zone=ZONE \
    --boot-disk-type=DISK_TYPE \
    --boot-disk-size=DISK_SIZE \
    --scopes=cloud-platform \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-0,subnet=GVNIC_NAME_PREFIX-sub-0 \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-1,subnet=GVNIC_NAME_PREFIX-sub-1,no-address 
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-2,subnet=GVNIC_NAME_PREFIX-sub-2,no-address \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-3,subnet=GVNIC_NAME_PREFIX-sub-3,no-address \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-4,subnet=GVNIC_NAME_PREFIX-sub-4,no-address \
    --provisioning-model=STANDARD \
    --maintenance-policy=TERMINATE \
    --reservation-affinity=RESERVATION_AFFINITY \
    --reservation=RESERVATION

כך עושים את זה:

  1. מחליפים את מה שכתוב בשדות הבאים:

    • INSTANCE_NAME: שם ה-VM.
    • MACHINE_TYPE: סוג המכונה שבה רוצים להשתמש עבור המכונה הווירטואלית. מידע נוסף זמין במאמר סוגי מכונות עם GPU במאמרי העזרה של Compute Engine.
    • IMAGE_FAMILY: משפחת התמונות של תמונת מערכת ההפעלה שרוצים להשתמש בה. רשימה של כל מערכות ההפעלה הנתמכות מופיעה במאמר בנושא מערכות הפעלה נתמכות. בסדרת מכונות A3 Edge, אנחנו ממליצים מאוד להשתמש בקובץ אימג' של מערכת הפעלה שמותאמת לקונטיינרים בגרסה cos-121-lts ואילך, ולהשבית את העדכונים האוטומטיים.
    • IMAGE_PROJECT: מזהה הפרויקט של תמונת מערכת ההפעלה. לדוגמה, אפשר להשתמש ב-cos-cloud עבור קובץ האימג' של מערכת הפעלה שמותאמת לקונטיינרים בגרסה cos-121-lts ואילך.
    • ZONE: האזור שבו זמין סוג המכונה שרוצים להשתמש בו. כדי לציין מדיניות למיקום קומפקטי, משתמשים באזור באותו אזור כמו המדיניות למיקום קומפקטי. מידע על אזורים זמין במאמר זמינות של GPU לפי אזורים ותחומים.
    • DISK_TYPE: סוג דיסק האתחול. לסדרת המכונות הזו, מומלץ להשתמש ב-hyperdisk-balanced. למידע נוסף על סוגי הדיסקים הנתמכים בסוג המכונה שלכם, אפשר לעיין במאמר מכונות GPU במשפחת מכונות שעברו אופטימיזציה למאיצים במסמכי העזרה של Compute Engine.
    • DISK_SIZE: גודל דיסק האתחול ב-GB. למידע נוסף, אפשר לעיין במאמרים מגבלות הגודל של Google Cloud Hyperdisk או מגבלות הגודל של Persistent Disk, בהתאם לסוג הדיסק.
    • GVNIC_NAME_PREFIX: תחילית השם שציינתם כשאתם יוצרים את רשתות ה-VPC הרגילות ואת רשתות המשנה שמשתמשות ב-gVNIC.
    • RESERVATION_AFFINITY: אם אפשר, מציינים את ההזמנות שהמופע יכול לנצל. מציינים אחת מהאפשרויות הבאות:

      • any (קיבולת ההזמנה היא אופציונלית): זו אפשרות ברירת המחדל. המופע מנסה להשתמש בקיבולת ממקום שמור שנעשה בו שימוש אוטומטי, וזה קורה רק אם יש קיבולת תואמת במקום השמור. אחרת, המופע משתמש בקיבולת על פי דרישה.

      • specific (נדרשת קיבולת ממקום שמור): המכונה חייבת להשתמש בקיבולת ממקום שמור שמיועד ספציפית למכונה. למופע אין הרשאה להשתמש בקיבולת לפי דרישה. אם הקיבולת של המקום השמור לא זמינה, יצירת המופע תיכשל.

    • RESERVATION: ההזמנה לשימוש. מציינים אחד מהערכים הבאים בהתאם לערך שציינתם עבור RESERVATION_AFFINITY:

      • אם ציינתם any, מחליפים את RESERVATION במחרוזת ריקה (""). לחלופין, אפשר להסיר לגמרי את הדגל --reservation.
      • אם ציינתם specific, מחליפים את RESERVATION בערך הבא:

        projects/RESERVATION_OWNER_PROJECT_ID/reservations/RESERVATION_NAME

        מחליפים את מה שכתוב בשדות הבאים:

        • RESERVATION_OWNER_PROJECT_ID: מזהה הפרויקט שבו נוצרה ההזמנה.
        • RESERVATION_NAME: השם של ההזמנה.
  2. כברירת מחדל, המכונה מופעלת מחדש באופן אוטומטי אם היא קורסת או אם Compute Engine מפסיק אותה בגלל עצירה מתוכנת, כמו אירוע תחזוקה. כדי להשבית את ההפעלה האוטומטית מחדש, מוסיפים את הדגל הבא:

    --no-restart-on-failure
  3. אופציונלי: כדי להשתמש במדיניות למיקום קומפקטי, מוסיפים את הדגל הבא:

      --resource-policies=POLICY_NAME
    

    מחליפים את מה שכתוב בשדות הבאים:

    • POLICY_NAME: השם של מדיניות המיקום הקומפקטי.
  4. מריצים את הפקודה.

על פי דרישה

לפני שמריצים את הפקודה, בודקים את כל השלבים הבאים כדי להחליט אם לכלול דגלים נוספים.

gcloud compute instances create INSTANCE_NAME  \
    --machine-type=MACHINE_TYPE \
    --image-family=IMAGE_FAMILY \
    --image-project=IMAGE_PROJECT \
    --zone=ZONE \
    --boot-disk-type=DISK_TYPE \
    --boot-disk-size=DISK_SIZE \
    --scopes=cloud-platform \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-0,subnet=GVNIC_NAME_PREFIX-sub-0 \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-1,subnet=GVNIC_NAME_PREFIX-sub-1,no-address 
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-2,subnet=GVNIC_NAME_PREFIX-sub-2,no-address \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-3,subnet=GVNIC_NAME_PREFIX-sub-3,no-address \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-4,subnet=GVNIC_NAME_PREFIX-sub-4,no-address \
    --provisioning-model=STANDARD \
    --maintenance-policy=TERMINATE \
    --reservation-affinity=RESERVATION_AFFINITY

כך עושים את זה:

  1. מחליפים את מה שכתוב בשדות הבאים:

    • INSTANCE_NAME: שם ה-VM.
    • MACHINE_TYPE: סוג המכונה שבה רוצים להשתמש עבור המכונה הווירטואלית. מידע נוסף זמין במאמר סוגי מכונות עם GPU במאמרי העזרה של Compute Engine.
    • IMAGE_FAMILY: משפחת התמונות של תמונת מערכת ההפעלה שרוצים להשתמש בה. רשימה של כל מערכות ההפעלה הנתמכות מופיעה במאמר בנושא מערכות הפעלה נתמכות. בסדרת מכונות A3 Edge, אנחנו ממליצים מאוד להשתמש בקובץ אימג' של מערכת הפעלה שמותאמת לקונטיינרים בגרסה cos-121-lts ואילך, ולהשבית את העדכונים האוטומטיים.
    • IMAGE_PROJECT: מזהה הפרויקט של תמונת מערכת ההפעלה. לדוגמה, אפשר להשתמש ב-cos-cloud עבור קובץ האימג' של מערכת הפעלה שמותאמת לקונטיינרים בגרסה cos-121-lts ואילך.
    • ZONE: האזור שבו זמין סוג המכונה שרוצים להשתמש בו. כדי לציין מדיניות למיקום קומפקטי, משתמשים באזור באותו אזור כמו המדיניות למיקום קומפקטי. מידע על אזורים זמין במאמר זמינות של GPU לפי אזורים ותחומים.
    • DISK_TYPE: סוג דיסק האתחול. לסדרת המכונות הזו, מומלץ להשתמש ב-hyperdisk-balanced. למידע נוסף על סוגי הדיסקים הנתמכים בסוג המכונה שלכם, אפשר לעיין במאמר מכונות GPU במשפחת מכונות שעברו אופטימיזציה למאיצים במסמכי העזרה של Compute Engine.
    • DISK_SIZE: גודל דיסק האתחול ב-GB. למידע נוסף, אפשר לעיין במאמרים מגבלות הגודל של Google Cloud Hyperdisk או מגבלות הגודל של Persistent Disk, בהתאם לסוג הדיסק.
    • GVNIC_NAME_PREFIX: תחילית השם שציינתם כשאתם יוצרים את רשתות ה-VPC הרגילות ואת רשתות המשנה שמשתמשות ב-gVNIC.
    • RESERVATION_AFFINITY: אם אפשר, מציינים את ההזמנות שהמופע יכול לנצל. מציינים אחת מהאפשרויות הבאות:

      • any (קיבולת ההזמנה היא אופציונלית): זו אפשרות ברירת המחדל. המופע מנסה להשתמש בקיבולת ממקום שמור שנעשה בו שימוש אוטומטי, וזה קורה רק אם יש קיבולת תואמת במקום השמור. אחרת, המופע משתמש בקיבולת על פי דרישה.

      • none (נדרשת קיבולת על פי דרישה): חסימת השימוש בקיבולת של מקום שמור במכונה.

  2. כברירת מחדל, המכונה מופעלת מחדש באופן אוטומטי אם היא קורסת או אם Compute Engine מפסיק אותה בגלל עצירה מתוכנת, כמו אירוע תחזוקה. כדי להשבית את ההפעלה האוטומטית מחדש, מוסיפים את הדגל הבא:

    --no-restart-on-failure
  3. אופציונלי: כדי להשתמש במדיניות למיקום קומפקטי, מוסיפים את הדגל הבא:

      --resource-policies=POLICY_NAME
    

    מחליפים את מה שכתוב בשדות הבאים:

    • POLICY_NAME: השם של מדיניות המיקום הקומפקטי.
  4. מריצים את הפקודה.

Flex-start

לפני שמריצים את הפקודה, בודקים את כל השלבים הבאים כדי להחליט אם לכלול דגלים נוספים.

gcloud compute instances create INSTANCE_NAME  \
    --machine-type=MACHINE_TYPE \
    --image-family=IMAGE_FAMILY \
    --image-project=IMAGE_PROJECT \
    --zone=ZONE \
    --boot-disk-type=DISK_TYPE \
    --boot-disk-size=DISK_SIZE \
    --scopes=cloud-platform \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-0,subnet=GVNIC_NAME_PREFIX-sub-0 \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-1,subnet=GVNIC_NAME_PREFIX-sub-1,no-address 
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-2,subnet=GVNIC_NAME_PREFIX-sub-2,no-address \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-3,subnet=GVNIC_NAME_PREFIX-sub-3,no-address \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-4,subnet=GVNIC_NAME_PREFIX-sub-4,no-address \
    --reservation-affinity=none \
    --provisioning-model=FLEX_START \
    --request-valid-for-duration=REQUEST_VALID_FOR_DURATION \
    --max-run-duration=MAX_RUN_DURATION \
    --instance-termination-action=TERMINATION_ACTION \
    --maintenance-policy=TERMINATE

כך עושים את זה:

  1. מחליפים את מה שכתוב בשדות הבאים:

    • INSTANCE_NAME: שם ה-VM.
    • MACHINE_TYPE: סוג המכונה שבה רוצים להשתמש עבור המכונה הווירטואלית. מידע נוסף זמין במאמר סוגי מכונות עם GPU במאמרי העזרה של Compute Engine.
    • IMAGE_FAMILY: משפחת התמונות של תמונת מערכת ההפעלה שרוצים להשתמש בה. רשימה של כל מערכות ההפעלה הנתמכות מופיעה במאמר בנושא מערכות הפעלה נתמכות. בסדרת מכונות A3 Edge, אנחנו ממליצים מאוד להשתמש בקובץ אימג' של מערכת הפעלה שמותאמת לקונטיינרים בגרסה cos-121-lts ואילך, ולהשבית את העדכונים האוטומטיים.
    • IMAGE_PROJECT: מזהה הפרויקט של תמונת מערכת ההפעלה. לדוגמה, אפשר להשתמש ב-cos-cloud עבור קובץ האימג' של מערכת הפעלה שמותאמת לקונטיינרים בגרסה cos-121-lts ואילך.
    • ZONE: האזור שבו זמין סוג המכונה שרוצים להשתמש בו. כדי לציין מדיניות למיקום קומפקטי, משתמשים באזור באותו אזור כמו המדיניות למיקום קומפקטי. מידע על אזורים זמין במאמר זמינות של GPU לפי אזורים ותחומים.
    • DISK_TYPE: סוג דיסק האתחול. לסדרת המכונות הזו, מומלץ להשתמש ב-hyperdisk-balanced. למידע נוסף על סוגי הדיסקים הנתמכים בסוג המכונה שלכם, אפשר לעיין במאמר מכונות GPU במשפחת מכונות שעברו אופטימיזציה למאיצים במסמכי העזרה של Compute Engine.
    • DISK_SIZE: גודל דיסק האתחול ב-GB. למידע נוסף, אפשר לעיין במאמרים מגבלות הגודל של Google Cloud Hyperdisk או מגבלות הגודל של Persistent Disk, בהתאם לסוג הדיסק.
    • GVNIC_NAME_PREFIX: תחילית השם שציינתם כשאתם יוצרים את רשתות ה-VPC הרגילות ואת רשתות המשנה שמשתמשות ב-gVNIC.
    • REQUEST_VALID_FOR_DURATION: משך הזמן שהבקשה ליצירת המכונה הווירטואלית (VM) נשארת בתוקף. הערך צריך להיות בפורמט של מספר הימים, השעות, הדקות או השניות, ואחריו d, h, m ו-s בהתאמה. לדוגמה, מציינים 30m ל-30 דקות או 1h2m3s לשעה, שתי דקות ושלוש שניות.

      בהתאם לדרישות האזוריות של עומס העבודה, מציינים את אחד משני משכי הזמן הבאים כדי להגדיל את הסיכויים שהבקשה ליצירת מכונה וירטואלית תצליח:

      • עומסי עבודה עם דרישות אזוריות מחמירות: אם עומס העבודה מחייב אתכם ליצור את המכונה הווירטואלית באזור ספציפי, צריך לציין משך זמן בין 90 שניות (90s) לשעתיים (2h). משך זמן ארוך יותר מגדיל את הסיכויים לקבל משאבים.
      • עומסי עבודה ללא דרישות מחמירות לגבי תחום: אם המכונה הווירטואלית יכולה לפעול בכל תחום באזור, צריך לציין משך של אפס שניות (0s). הפעולה הזו מציינת ש-Compute Engine יקצה משאבים רק אם הם זמינים באופן מיידי. אם הבקשה ליצירת מכונה וירטואלית נכשלת כי המשאבים לא זמינים, צריך לנסות שוב את הבקשה באזור אחר.
    • MAX_RUN_DURATION: משך הזמן שבו רוצים שהמכונות הווירטואליות המבוקשות יפעלו. צריך להזין את הערך בפורמט של מספר הימים, השעות, הדקות או השניות, ואחריו את הערכים d, h, m ו-s בהתאמה. הערך צריך להיות בין 10 דקות לשבעה ימים.

    • TERMINATION_ACTION: מציין אם Compute Engine מפסיק (STOP) או מוחק (DELETE) את המכונה הווירטואלית בסוף משך ההפעלה שלה.

  2. אופציונלי: כדי להשתמש במדיניות למיקום קומפקטי, מוסיפים את הדגל הבא:

      --resource-policies=POLICY_NAME
    

    מחליפים את מה שכתוב בשדות הבאים:

    • POLICY_NAME: השם של מדיניות המיקום הקומפקטי.
  3. מריצים את הפקודה.

Spot

לפני שמריצים את הפקודה, בודקים את כל השלבים הבאים כדי להחליט אם לכלול דגלים נוספים.

gcloud compute instances create INSTANCE_NAME  \
    --machine-type=MACHINE_TYPE \
    --image-family=IMAGE_FAMILY \
    --image-project=IMAGE_PROJECT \
    --zone=ZONE \
    --boot-disk-type=DISK_TYPE \
    --boot-disk-size=DISK_SIZE \
    --scopes=cloud-platform \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-0,subnet=GVNIC_NAME_PREFIX-sub-0 \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-1,subnet=GVNIC_NAME_PREFIX-sub-1,no-address 
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-2,subnet=GVNIC_NAME_PREFIX-sub-2,no-address \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-3,subnet=GVNIC_NAME_PREFIX-sub-3,no-address \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-4,subnet=GVNIC_NAME_PREFIX-sub-4,no-address \
    --provisioning-model=SPOT \
    --instance-termination-action=TERMINATION_ACTION \
    --maintenance-policy=TERMINATE \
    --no-restart-on-failure

כך עושים את זה:

  1. מחליפים את מה שכתוב בשדות הבאים:

    • INSTANCE_NAME: שם ה-VM.
    • MACHINE_TYPE: סוג המכונה שבה רוצים להשתמש עבור המכונה הווירטואלית. מידע נוסף זמין במאמר סוגי מכונות עם GPU במאמרי העזרה של Compute Engine.
    • IMAGE_FAMILY: משפחת התמונות של תמונת מערכת ההפעלה שרוצים להשתמש בה. רשימה של כל מערכות ההפעלה הנתמכות מופיעה במאמר בנושא מערכות הפעלה נתמכות. בסדרת מכונות A3 Edge, אנחנו ממליצים מאוד להשתמש בקובץ אימג' של מערכת הפעלה שמותאמת לקונטיינרים בגרסה cos-121-lts ואילך, ולהשבית את העדכונים האוטומטיים.
    • IMAGE_PROJECT: מזהה הפרויקט של תמונת מערכת ההפעלה. לדוגמה, אפשר להשתמש ב-cos-cloud עבור קובץ האימג' של מערכת הפעלה שמותאמת לקונטיינרים בגרסה cos-121-lts ואילך.
    • ZONE: האזור שבו זמין סוג המכונה שרוצים להשתמש בו. כדי לציין מדיניות למיקום קומפקטי, משתמשים באזור באותו אזור כמו המדיניות למיקום קומפקטי. מידע על אזורים זמין במאמר זמינות של GPU לפי אזורים ותחומים.
    • DISK_TYPE: סוג דיסק האתחול. לסדרת המכונות הזו, מומלץ להשתמש ב-hyperdisk-balanced. למידע נוסף על סוגי הדיסקים הנתמכים בסוג המכונה שלכם, אפשר לעיין במאמר מכונות GPU במשפחת מכונות שעברו אופטימיזציה למאיצים במסמכי העזרה של Compute Engine.
    • DISK_SIZE: גודל דיסק האתחול ב-GB. למידע נוסף, אפשר לעיין במאמרים מגבלות הגודל של Google Cloud Hyperdisk או מגבלות הגודל של Persistent Disk, בהתאם לסוג הדיסק.
    • GVNIC_NAME_PREFIX: תחילית השם שציינתם כשאתם יוצרים את רשתות ה-VPC הרגילות ואת רשתות המשנה שמשתמשות ב-gVNIC.
    • TERMINATION_ACTION: הפעולה שתתבצע כש-Compute Engine יבצע דחיקה של המכונה, האפשרויות הן STOP (ברירת מחדל) או DELETE.

  2. אופציונלי: כדי להשתמש במדיניות למיקום קומפקטי, מוסיפים את הדגל הבא:

      --resource-policies=POLICY_NAME
    

    מחליפים את מה שכתוב בשדות הבאים:

    • POLICY_NAME: השם של מדיניות המיקום הקומפקטי.
  3. מריצים את הפקודה.

REST

כדי ליצור את המכונה הווירטואלית, שולחים בקשת POST אל ה-method‏ instances.insert.

הפרמטרים שצריך לציין תלויים באפשרות הצריכה שבה אתם משתמשים לפריסה הזו. בוחרים את הכרטיסייה שמתאימה לאפשרות הצריכה שלכם.

הזמנה

מופעי A3 Edge תומכים בסוגי ההזמנות הבאים:

  • הזמנות על פי דרישה
  • הזמנות רגילות לעתיד

כדי להשתמש בסוגי ההזמנות האלה, צריך להשתמש במודל הקצאת המשאבים הרגיל. לדוגמה, משתמשים בפרמטרים הבאים ליצירה.

לפני ששולחים את הבקשה, כדאי לעיין בכל השלבים הבאים כדי להחליט אם לכלול שדות נוספים.

POST https://compute.googleapis.com/compute/v1/projects/PROJECT_ID/zones/ZONE/instances
{
  "machineType": "projects/PROJECT_ID/zones/ZONE/machineTypes/MACHINE_TYPE",
  "name": "INSTANCE_NAME",
  "disks": [
    {
      "boot": true,
      "initializeParams": {
        "diskSizeGb": "DISK_SIZE",
        "diskType": "DISK_TYPE",
        "sourceImage": "projects/IMAGE_PROJECT/global/images/family/IMAGE_FAMILY"
      },
      "mode": "READ_WRITE",
      "type": "PERSISTENT"
    }
  ],
  "serviceAccounts": [
    {
      "email": "default",
      "scopes": [
        "https://www.googleapis.com/auth/cloud-platform"
      ]
    }
  ],
  "networkInterfaces": [
      {
        "accessConfigs": [
          {
            "name": "external-nat",
            "type": "ONE_TO_ONE_NAT"
          }
        ],
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-0",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-0"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-1",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-1"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-2",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-2"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-3",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-3"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-4",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-4"
      },
  "scheduling": {
    "provisioningModel": "STANDARD",
    "onHostMaintenance": "TERMINATE",
    "automaticRestart": AUTOMATIC_RESTART
  },
  "reservationAffinity": {
    "consumeReservationType": "RESERVATION_AFFINITY",
    "key": "compute.googleapis.com/reservation-name",
    "values": [
      "RESERVATION"
    ]
  }
}

כך עושים את זה:

  1. מחליפים את מה שכתוב בשדות הבאים:

    • PROJECT_ID: מזהה הפרויקט שבו רוצים ליצור את המכונה הווירטואלית.
    • ZONE: האזור שבו זמין סוג המכונה שרוצים להשתמש בו. אם רוצים לציין מדיניות למיקום קומפקטי, צריך להשתמש באזור שנמצא באותו אזור כמו המדיניות למיקום קומפקטי. מידע על אזורים זמין במאמר זמינות של GPU לפי אזורים ותחומים.
    • MACHINE_TYPE: סוג המכונה שבה רוצים להשתמש עבור המכונה הווירטואלית. מידע נוסף זמין במאמר סוגי מכונות עם GPU במאמרי העזרה של Compute Engine.
    • INSTANCE_NAME: שם ה-VM.
    • DISK_SIZE: גודל דיסק האתחול ב-GB. למידע נוסף, אפשר לעיין במאמרים מגבלות הגודל של Google Cloud Hyperdisk או מגבלות הגודל של Persistent Disk, בהתאם לסוג הדיסק.
    • DISK_TYPE: סוג דיסק האתחול. לסדרת המכונות הזו, מומלץ להשתמש ב-hyperdisk-balanced. למידע נוסף על סוגי הדיסקים הנתמכים בסוג המכונה שלכם, אפשר לעיין במאמר מכונות GPU במשפחת מכונות שעברו אופטימיזציה למאיצים במסמכי העזרה של Compute Engine.
    • IMAGE_PROJECT: מזהה הפרויקט של תמונת מערכת ההפעלה.
    • IMAGE_FAMILY: משפחת התמונות של תמונת מערכת ההפעלה שרוצים להשתמש בה. רשימה של כל מערכות ההפעלה הנתמכות מופיעה במאמר בנושא מערכות הפעלה נתמכות. בסדרת מכונות A3 Edge, אנחנו ממליצים מאוד להשתמש בקובץ אימג' של מערכת הפעלה שמותאמת לקונטיינרים בגרסה cos-121-lts ואילך, ולהשבית את העדכונים האוטומטיים.
    • NETWORK_PROJECT_ID: מזהה הפרויקט של הרשת.
    • GVNIC_NAME_PREFIX: תחילית השם שציינתם כשאתם יוצרים את רשתות ה-VPC הרגילות ואת רשתות המשנה שמשתמשות ב-gVNIC.
    • REGION: האזור של רשת המשנה.
    • AUTOMATIC_RESTART: אם המכונה שלכם מופעלת מחדש באופן אוטומטי אם היא קורסת או אם Compute Engine מפסיק אותה לצורך עצירה מתוכנתת, כמו אירוע תחזוקה. מציינים את האפשרות true כדי להפעיל הפעלה אוטומטית מחדש (ברירת מחדל) או את האפשרות false כדי להשבית הפעלה אוטומטית מחדש.

    • RESERVATION_AFFINITY: אם אפשר, מציינים את ההזמנות שהמופע יכול לנצל. מציינים אחת מהאפשרויות הבאות:

      • ANY_RESERVATION (קיבולת ההזמנה היא אופציונלית): זו אפשרות ברירת המחדל. המופע מנסה להשתמש בקיבולת ממקום שמור שנעשה בו שימוש אוטומטי, וזה קורה רק אם יש קיבולת תואמת במקום השמור. אחרת, המופע משתמש בקיבולת על פי דרישה.

      • SPECIFIC_RESERVATION (נדרשת קיבולת ממקום שמור): המכונה חייבת להשתמש בקיבולת ממקום שמור שמיועד ספציפית למכונה. למופע אין הרשאה להשתמש בקיבולת לפי דרישה. אם הקיבולת של המקום השמור לא זמינה, יצירת המופע תיכשל.

    • RESERVATION: ההזמנה לשימוש. מציינים אחד מהערכים הבאים בהתאם לערך שציינתם עבור RESERVATION_AFFINITY:

      • אם ציינתם את ANY_RESERVATION, צריך למחוק את RESERVATION כדי שהערך יהיה מחרוזת ריקה (""). לחלופין, אפשר להסיר לגמרי את השדות key ו-values.
      • אם ציינתם SPECIFIC_RESERVATION, מחליפים את RESERVATION בערך הבא:

        projects/RESERVATION_OWNER_PROJECT_ID/reservations/RESERVATION_NAME

        מחליפים את מה שכתוב בשדות הבאים:

        • RESERVATION_OWNER_PROJECT_ID: מזהה הפרויקט שבו נוצרה ההזמנה.
        • RESERVATION_NAME: השם של ההזמנה.
  2. אופציונלי: אם בחרתם להשתמש במדיניות מיקום קומפקטית, מוסיפים את השדה הבא לגוף הבקשה:

      "resourcePolicies": [
        "projects/PROJECT_ID/regions/REGION/resourcePolicies/POLICY_NAME"
      ]
    

    מחליפים את מה שכתוב בשדות הבאים:

    • PROJECT_ID: מזהה הפרויקט של מדיניות המיקום הקומפקטית.
    • REGION: האזור של מדיניות המיקום הקומפקטי.
    • POLICY_NAME: השם של מדיניות המיקום הקומפקטי.
  3. שולחים את הבקשה.

על פי דרישה

לפני ששולחים את הבקשה, כדאי לעיין בכל השלבים הבאים כדי להחליט אם לכלול שדות נוספים.

POST https://compute.googleapis.com/compute/v1/projects/PROJECT_ID/zones/ZONE/instances
{
  "machineType": "projects/PROJECT_ID/zones/ZONE/machineTypes/MACHINE_TYPE",
  "name": "INSTANCE_NAME",
  "disks": [
    {
      "boot": true,
      "initializeParams": {
        "diskSizeGb": "DISK_SIZE",
        "diskType": "DISK_TYPE",
        "sourceImage": "projects/IMAGE_PROJECT/global/images/family/IMAGE_FAMILY"
      },
      "mode": "READ_WRITE",
      "type": "PERSISTENT"
    }
  ],
  "serviceAccounts": [
    {
      "email": "default",
      "scopes": [
        "https://www.googleapis.com/auth/cloud-platform"
      ]
    }
  ],
  "networkInterfaces": [
      {
        "accessConfigs": [
          {
            "name": "external-nat",
            "type": "ONE_TO_ONE_NAT"
          }
        ],
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-0",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-0"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-1",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-1"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-2",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-2"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-3",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-3"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-4",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-4"
      },
  "scheduling": {
    "provisioningModel": "STANDARD",
    "onHostMaintenance": "TERMINATE",
    "automaticRestart": AUTOMATIC_RESTART
  },
  "reservationAffinity": {
    "consumeReservationType": "RESERVATION_AFFINITY"
  }
}

כך עושים את זה:

  1. מחליפים את מה שכתוב בשדות הבאים:

    • PROJECT_ID: מזהה הפרויקט שבו רוצים ליצור את המכונה הווירטואלית.
    • ZONE: האזור שבו זמין סוג המכונה שרוצים להשתמש בו. אם רוצים לציין מדיניות למיקום קומפקטי, צריך להשתמש באזור שנמצא באותו אזור כמו המדיניות למיקום קומפקטי. מידע על אזורים זמין במאמר זמינות של GPU לפי אזורים ותחומים.
    • MACHINE_TYPE: סוג המכונה שבה רוצים להשתמש עבור המכונה הווירטואלית. מידע נוסף זמין במאמר סוגי מכונות עם GPU במאמרי העזרה של Compute Engine.
    • INSTANCE_NAME: שם ה-VM.
    • DISK_SIZE: גודל דיסק האתחול ב-GB. למידע נוסף, אפשר לעיין במאמרים מגבלות הגודל של Google Cloud Hyperdisk או מגבלות הגודל של Persistent Disk, בהתאם לסוג הדיסק.
    • DISK_TYPE: סוג דיסק האתחול. לסדרת המכונות הזו, מומלץ להשתמש ב-hyperdisk-balanced. למידע נוסף על סוגי הדיסקים הנתמכים בסוג המכונה שלכם, אפשר לעיין במאמר מכונות GPU במשפחת מכונות שעברו אופטימיזציה למאיצים במסמכי העזרה של Compute Engine.
    • IMAGE_PROJECT: מזהה הפרויקט של תמונת מערכת ההפעלה.
    • IMAGE_FAMILY: משפחת התמונות של תמונת מערכת ההפעלה שרוצים להשתמש בה. רשימה של כל מערכות ההפעלה הנתמכות מופיעה במאמר בנושא מערכות הפעלה נתמכות. בסדרת מכונות A3 Edge, אנחנו ממליצים מאוד להשתמש בקובץ אימג' של מערכת הפעלה שמותאמת לקונטיינרים בגרסה cos-121-lts ואילך, ולהשבית את העדכונים האוטומטיים.
    • NETWORK_PROJECT_ID: מזהה הפרויקט של הרשת.
    • GVNIC_NAME_PREFIX: תחילית השם שציינתם כשאתם יוצרים את רשתות ה-VPC הרגילות ואת רשתות המשנה שמשתמשות ב-gVNIC.
    • REGION: האזור של רשת המשנה.
    • AUTOMATIC_RESTART: אם המכונה שלכם מופעלת מחדש באופן אוטומטי אם היא קורסת או אם Compute Engine מפסיק אותה לצורך עצירה מתוכנתת, כמו אירוע תחזוקה. מציינים את האפשרות true כדי להפעיל הפעלה אוטומטית מחדש (ברירת מחדל) או את האפשרות false כדי להשבית הפעלה אוטומטית מחדש.

    • RESERVATION_AFFINITY: אם אפשר, מציינים את ההזמנות שהמופע יכול לנצל. מציינים אחת מהאפשרויות הבאות:

      • ANY_RESERVATION (קיבולת ההזמנה היא אופציונלית): זו אפשרות ברירת המחדל. המופע מנסה להשתמש בקיבולת ממקום שמור שנעשה בו שימוש אוטומטי, וזה קורה רק אם יש קיבולת תואמת במקום השמור. אחרת, המופע משתמש בקיבולת על פי דרישה.

      • NO_RESERVATION (נדרשת קיבולת על פי דרישה): חסימת השימוש בקיבולת של מקום שמור במכונה.

  2. אופציונלי: אם בחרתם להשתמש במדיניות מיקום קומפקטית, מוסיפים את השדה הבא לגוף הבקשה:

      "resourcePolicies": [
        "projects/PROJECT_ID/regions/REGION/resourcePolicies/POLICY_NAME"
      ]
    

    מחליפים את מה שכתוב בשדות הבאים:

    • PROJECT_ID: מזהה הפרויקט של מדיניות המיקום הקומפקטית.
    • REGION: האזור של מדיניות המיקום הקומפקטי.
    • POLICY_NAME: השם של מדיניות המיקום הקומפקטי.
  3. שולחים את הבקשה.

Flex-start

לפני ששולחים את הבקשה, כדאי לעיין בכל השלבים הבאים כדי להחליט אם לכלול שדות נוספים.

POST https://compute.googleapis.com/compute/v1/projects/PROJECT_ID/zones/ZONE/instances
{
  "machineType": "projects/PROJECT_ID/zones/ZONE/machineTypes/MACHINE_TYPE",
  "name": "INSTANCE_NAME",
  "disks": [
    {
      "boot": true,
      "initializeParams": {
        "diskSizeGb": "DISK_SIZE",
        "diskType": "DISK_TYPE",
        "sourceImage": "projects/IMAGE_PROJECT/global/images/family/IMAGE_FAMILY"
      },
      "mode": "READ_WRITE",
      "type": "PERSISTENT"
    }
  ],
  "serviceAccounts": [
    {
      "email": "default",
      "scopes": [
        "https://www.googleapis.com/auth/cloud-platform"
      ]
    }
  ],
  "networkInterfaces": [
      {
        "accessConfigs": [
          {
            "name": "external-nat",
            "type": "ONE_TO_ONE_NAT"
          }
        ],
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-0",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-0"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-1",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-1"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-2",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-2"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-3",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-3"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-4",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-4"
      },
  "reservationAffinity": {
    "consumeReservationType": "NO_RESERVATION",
  },
  "scheduling": {
    "provisioningModel": "FLEX_START",
    "requestValidForDuration": {
      "seconds": REQUEST_VALID_FOR_DURATION
    },
    "maxRunDuration": {
      "seconds": MAX_RUN_DURATION
    },
    "instanceTerminationAction": "TERMINATION_ACTION",
    "onHostMaintenance": "TERMINATE",
  }
}

כך עושים את זה:

  1. מחליפים את מה שכתוב בשדות הבאים:

    • PROJECT_ID: מזהה הפרויקט שבו רוצים ליצור את המכונה הווירטואלית.
    • ZONE: האזור שבו זמין סוג המכונה שרוצים להשתמש בו. אם רוצים לציין מדיניות למיקום קומפקטי, צריך להשתמש באזור שנמצא באותו אזור כמו המדיניות למיקום קומפקטי. מידע על אזורים זמין במאמר זמינות של GPU לפי אזורים ותחומים.
    • MACHINE_TYPE: סוג המכונה שבה רוצים להשתמש עבור המכונה הווירטואלית. מידע נוסף זמין במאמר סוגי מכונות עם GPU במאמרי העזרה של Compute Engine.
    • INSTANCE_NAME: שם ה-VM.
    • DISK_SIZE: גודל דיסק האתחול ב-GB. למידע נוסף, אפשר לעיין במאמרים מגבלות הגודל של Google Cloud Hyperdisk או מגבלות הגודל של Persistent Disk, בהתאם לסוג הדיסק.
    • DISK_TYPE: סוג דיסק האתחול. לסדרת המכונות הזו, מומלץ להשתמש ב-hyperdisk-balanced. למידע נוסף על סוגי הדיסקים הנתמכים בסוג המכונה שלכם, אפשר לעיין במאמר מכונות GPU במשפחת מכונות שעברו אופטימיזציה למאיצים במסמכי העזרה של Compute Engine.
    • IMAGE_PROJECT: מזהה הפרויקט של תמונת מערכת ההפעלה.
    • IMAGE_FAMILY: משפחת התמונות של תמונת מערכת ההפעלה שרוצים להשתמש בה. רשימה של כל מערכות ההפעלה הנתמכות מופיעה במאמר בנושא מערכות הפעלה נתמכות. בסדרת מכונות A3 Edge, אנחנו ממליצים מאוד להשתמש בקובץ אימג' של מערכת הפעלה שמותאמת לקונטיינרים בגרסה cos-121-lts ואילך, ולהשבית את העדכונים האוטומטיים.
    • NETWORK_PROJECT_ID: מזהה הפרויקט של הרשת.
    • GVNIC_NAME_PREFIX: תחילית השם שציינתם כשאתם יוצרים את רשתות ה-VPC הרגילות ואת רשתות המשנה שמשתמשות ב-gVNIC.
    • REGION: האזור של רשת המשנה.
    • REQUEST_VALID_FOR_DURATION: משך הזמן, בשניות, שבו הבקשה ליצירת המכונה הווירטואלית נשארת בתוקף.

      בהתאם לדרישות האזוריות של עומס העבודה, מציינים את אחד משני משכי הזמן הבאים כדי להגדיל את הסיכויים שהבקשה ליצירת מכונה וירטואלית תצליח:

      • עומסי עבודה עם דרישות אזוריות מחמירות: אם עומס העבודה מחייב אתכם ליצור את המכונה הווירטואלית באזור ספציפי, צריך לציין משך זמן בין 90 שניות (90) לשעתיים (7200). משך זמן ארוך יותר מגדיל את הסיכויים לקבל משאבים.
      • עומסי עבודה ללא דרישות מחמירות לגבי תחום: אם המכונה הווירטואלית יכולה לפעול בכל תחום באזור, צריך לציין משך של אפס שניות (0). הפעולה הזו מציינת ש-Compute Engine יקצה משאבים רק אם הם זמינים באופן מיידי. אם הבקשה ליצירת מכונה וירטואלית נכשלת כי המשאבים לא זמינים, צריך לנסות שוב את הבקשה באזור אחר.
    • MAX_RUN_DURATION: משך הזמן שבו רוצים שהמכונות הווירטואליות המבוקשות יפעלו. אתם צריכים לעצב את הערך כמספר השניות. לדוגמה, מציינים 86400 ל-86,400 שניות (24 שעות). הערך צריך להיות בין 10 דקות לשבעה ימים.

    • TERMINATION_ACTION: מציין אם Compute Engine מפסיק (STOP) או מוחק (DELETE) את המכונה הווירטואלית בסוף משך ההפעלה שלה.

  2. אופציונלי: אם בחרתם להשתמש במדיניות מיקום קומפקטית, מוסיפים את השדה הבא לגוף הבקשה:

      "resourcePolicies": [
        "projects/PROJECT_ID/regions/REGION/resourcePolicies/POLICY_NAME"
      ]
    

    מחליפים את מה שכתוב בשדות הבאים:

    • PROJECT_ID: מזהה הפרויקט של מדיניות המיקום הקומפקטית.
    • REGION: האזור של מדיניות המיקום הקומפקטי.
    • POLICY_NAME: השם של מדיניות המיקום הקומפקטי.
  3. שולחים את הבקשה.

Spot

לפני ששולחים את הבקשה, כדאי לעיין בכל השלבים הבאים כדי להחליט אם לכלול שדות נוספים.

POST https://compute.googleapis.com/compute/v1/projects/PROJECT_ID/zones/ZONE/instances
{
  "machineType": "projects/PROJECT_ID/zones/ZONE/machineTypes/MACHINE_TYPE",
  "name": "INSTANCE_NAME",
  "disks": [
    {
      "boot": true,
      "initializeParams": {
        "diskSizeGb": "DISK_SIZE",
        "diskType": "DISK_TYPE",
        "sourceImage": "projects/IMAGE_PROJECT/global/images/family/IMAGE_FAMILY"
      },
      "mode": "READ_WRITE",
      "type": "PERSISTENT"
    }
  ],
  "serviceAccounts": [
    {
      "email": "default",
      "scopes": [
        "https://www.googleapis.com/auth/cloud-platform"
      ]
    }
  ],
  "networkInterfaces": [
      {
        "accessConfigs": [
          {
            "name": "external-nat",
            "type": "ONE_TO_ONE_NAT"
          }
        ],
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-0",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-0"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-1",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-1"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-2",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-2"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-3",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-3"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-4",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-4"
      },
  "scheduling":
  {
    "provisioningModel": "SPOT",
    "instanceTerminationAction": "TERMINATION_ACTION",
    "onHostMaintenance": "TERMINATE",
    "automaticRestart": false
  }
}

כך עושים את זה:

  1. מחליפים את מה שכתוב בשדות הבאים:

    • PROJECT_ID: מזהה הפרויקט שבו רוצים ליצור את המכונה הווירטואלית.
    • ZONE: האזור שבו זמין סוג המכונה שרוצים להשתמש בו. אם רוצים לציין מדיניות למיקום קומפקטי, צריך להשתמש באזור שנמצא באותו אזור כמו המדיניות למיקום קומפקטי. מידע על אזורים זמין במאמר זמינות של GPU לפי אזורים ותחומים.
    • MACHINE_TYPE: סוג המכונה שבה רוצים להשתמש עבור המכונה הווירטואלית. מידע נוסף זמין במאמר סוגי מכונות עם GPU במאמרי העזרה של Compute Engine.
    • INSTANCE_NAME: שם ה-VM.
    • DISK_SIZE: גודל דיסק האתחול ב-GB. למידע נוסף, אפשר לעיין במאמרים מגבלות הגודל של Google Cloud Hyperdisk או מגבלות הגודל של Persistent Disk, בהתאם לסוג הדיסק.
    • DISK_TYPE: סוג דיסק האתחול. לסדרת המכונות הזו, מומלץ להשתמש ב-hyperdisk-balanced. למידע נוסף על סוגי הדיסקים הנתמכים בסוג המכונה שלכם, אפשר לעיין במאמר מכונות GPU במשפחת מכונות שעברו אופטימיזציה למאיצים במסמכי העזרה של Compute Engine.
    • IMAGE_PROJECT: מזהה הפרויקט של תמונת מערכת ההפעלה.
    • IMAGE_FAMILY: משפחת התמונות של תמונת מערכת ההפעלה שרוצים להשתמש בה. רשימה של כל מערכות ההפעלה הנתמכות מופיעה במאמר בנושא מערכות הפעלה נתמכות. בסדרת מכונות A3 Edge, אנחנו ממליצים מאוד להשתמש בקובץ אימג' של מערכת הפעלה שמותאמת לקונטיינרים בגרסה cos-121-lts ואילך, ולהשבית את העדכונים האוטומטיים.
    • NETWORK_PROJECT_ID: מזהה הפרויקט של הרשת.
    • GVNIC_NAME_PREFIX: תחילית השם שציינתם כשאתם יוצרים את רשתות ה-VPC הרגילות ואת רשתות המשנה שמשתמשות ב-gVNIC.
    • REGION: האזור של רשת המשנה.
    • TERMINATION_ACTION: הפעולה שתתבצע כש-Compute Engine יבצע דחיקה של המכונה, האפשרויות הן STOP (ברירת מחדל) או DELETE.

  2. אופציונלי: אם בחרתם להשתמש במדיניות מיקום קומפקטית, מוסיפים את השדה הבא לגוף הבקשה:

      "resourcePolicies": [
        "projects/PROJECT_ID/regions/REGION/resourcePolicies/POLICY_NAME"
      ]
    

    מחליפים את מה שכתוב בשדות הבאים:

    • PROJECT_ID: מזהה הפרויקט של מדיניות המיקום הקומפקטית.
    • REGION: האזור של מדיניות המיקום הקומפקטי.
    • POLICY_NAME: השם של מדיניות המיקום הקומפקטי.
  3. שולחים את הבקשה.

התקנת דרייברים של GPU

אחרי שיוצרים מופע, המופע לא יכול להשתמש ב-GPU שלו אלא אם מנהלי ההתקנים הנכונים של ה-GPU כבר מותקנים. אם לא ציינתם תמונת מערכת הפעלה שכוללת מנהלי התקנים של GPU, תוכלו לעיין במאמר התקנת מנהלי התקנים של GPU במסמכי התיעוד של Compute Engine.

אופציונלי: הפעלת מצב NVIDIA Multi-Instance GPU

מצב Multi-Instance GPU ‏ (MIG) הוא תכונה שאפשר להפעיל בGPU נתמך של NVIDIA. אחרי שיוצרים מכונה, אפשר להפעיל את מצב MIG במעבד גרפי יחיד שמצורף למכונה. כשמצב MIG מופעל, ה-GPU היחיד מחולק לשבעה מופעי GPU עצמאיים לכל היותר. כל מופע פועל בו-זמנית, ולכל אחד מהם יש זיכרון, מטמון ומעבדים מרובי-ליבות משלו לסטרימינג. לאחר מכן, תוכלו להריץ במקביל עומסי עבודה שונים במכונות ה-GPU האלה. מידע נוסף על שימוש במצב MIG זמין במדריך למשתמש של Multi-Instance GPU (MIG) במסמכי התיעוד של NVIDIA.

המאמרים הבאים