אתם יכולים ליצור מכונה שמשתמשת ב-Advanced Compute Images כדי לספק סביבה אופטימלית לעומסי עבודה של בינה מלאכותית (AI), למידת מכונה (ML) ומחשוב עתיר ביצועים (HPC). אפשר להשתמש בממשקים הבאים:
- Google Cloud CLI
- Google Cloud console
- הכלי לניהול עומס העבודה Slurm של SchedMD
מידע נוסף על Advanced Compute Images זמין במאמר סקירה כללית של Advanced Compute Images.
לפני שמתחילים
-
אם עדיין לא עשיתם את זה, תצטרכו להגדיר אימות.
אימות הוא תהליך שבו מאמתים את הזהות שלכם כדי לקבל גישה לממשקי API ולשירותים של Google Cloud . כדי להריץ קוד או דוגמאות מסביבת פיתוח מקומית, אפשר לבצע אימות ל-Compute Engine באחת מהדרכים הבאות:
צריך לבחור את הכרטיסייה הרלוונטית לאופן שבו תכננתם להשתמש בדוגמאות בדף הזה:
המסוף
כשמשתמשים במסוף Google Cloud כדי לגשת לשירותים Google Cloud ולממשקי ה-API, לא צריך להגדיר אימות.
gcloud
-
התקינו את ה-CLI של Google Cloud. אחר כך, מאתחלים את ה-CLI של Google Cloud באמצעות הפקודה הבאה:
gcloud initאם אתם משתמשים בספק זהויות חיצוני (IdP), קודם אתם צריכים להיכנס ל-CLI של gcloud באמצעות המאגר המאוחד לניהול זהויות.
-
- הגדרת אזור ותחום כברירת מחדל
התפקידים הנדרשים
כדי לקבל את ההרשאות שנדרשות ליצירת מכונות, צריך לבקש מהאדמין להקצות לכם ב-IAM את התפקיד אדמין מכונות של Compute (v1) (roles/compute.instanceAdmin.v1) בפרויקט.
כדי לקרוא הסבר על מתן תפקידים, ראו איך מנהלים את הגישה ברמת הפרויקט, התיקייה והארגון.
זהו תפקיד שמוגדר מראש וכולל את ההרשאות שנדרשות ליצירת מכונות. כדי לראות בדיוק אילו הרשאות נדרשות, אפשר להרחיב את הקטע ההרשאות הנדרשות:
ההרשאות הנדרשות
כדי ליצור מכונות, צריך את ההרשאות הבאות:
-
compute.instances.createבפרויקט -
כדי להשתמש באימג' בהתאמה אישית ליצירת המכונה הווירטואלית (VM):
compute.images.useReadOnlyבקובץ אימג' -
כדי להשתמש ב-snapshot ליצירת המכונה הווירטואלית:
compute.snapshots.useReadOnlyבקובץ snapshot -
כדי להשתמש בתבנית של הגדרות מכונה ליצירת המכונה הווירטואלית:
compute.instanceTemplates.useReadOnlyבתבנית של הגדרות המכונה -
כדי לציין רשת משנה למכונה הווירטואלית:
compute.subnetworks.useבפרויקט או ברשת המשנה שנבחרה -
כדי לציין כתובת IP סטטית למכונה הווירטואלית:
compute.addresses.useבפרויקט -
כדי להקצות כתובת IP חיצונית למכונה הווירטואלית כשמשתמשים ברשת VPC:
compute.subnetworks.useExternalIpבפרויקט או ברשת המשנה שנבחרה -
כדי להקצות רשת מדור קודם למכונה הווירטואלית:
compute.networks.useבפרויקט -
כדי להקצות כתובת IP חיצונית למכונה הווירטואלית כשמשתמשים ברשת מדור קודם:
compute.networks.useExternalIpבפרויקט -
כדי להגדיר מטא-נתונים של המכונה הווירטואלית:
compute.instances.setMetadataבפרויקט -
כדי להגדיר תגים למכונה הווירטואלית:
compute.instances.setTagsבמכונה הווירטואלית -
כדי להגדיר תוויות למכונה הווירטואלית:
compute.instances.setLabelsבמכונה הווירטואלית -
כדי להגדיר חשבון שירות לשימוש של המכונה הווירטואלית:
compute.instances.setServiceAccountבמכונה הווירטואלית -
כדי ליצור דיסק חדש למכונה הווירטואלית:
compute.disks.createבפרויקט -
כדי לצרף דיסק קיים במצב קריאה-בלבד או במצב קריאה וכתיבה:
compute.disks.useבדיסק -
כדי לצרף דיסק קיים במצב קריאה-בלבד:
compute.disks.useReadOnlyבדיסק
יכול להיות שתקבלו את ההרשאות האלה באמצעות תפקידים בהתאמה אישית או תפקידים מוגדרים מראש אחרים.
מדריך למתחילים
במדריך הזה מתוארים השלבים ליצירת מכונת A3 Ultra או A4 שמשתמשת בתמונות מתקדמות של Compute כדי להגדיר ולהתאים אישית את מערכת ההפעלה של האורח.
דרישות מוקדמות
לפני שיוצרים מכונה, צריך לבצע את המשימות הבאות ליצירת מכונות A3 Ultra ו-A4:
יצירת מכונה של Compute Engine באמצעות Advanced Compute Images
אחרי שביצעתם את המשימות הנדרשות, אתם יכולים להשתמש באחת מהשיטות הבאות כדי ליצור את המכונה.
המסוף
נכנסים לדף Create an instance במסוף Google Cloud .
אם מתבקשים, בוחרים פרויקט ולוחצים על המשך. מופיע הדף Create an instance ובו החלונית Machine configuration.
בחלונית Machine configuration:
- בשדה Name (שם), מציינים שם למופע של המחשוב. מידע נוסף מופיע במאמר מוסכמות למתן שמות למשאבים.
בוחרים Region ו-Zone למכונה. אם שריינתם את משאבי המחשוב, האזור והתחום שתבחרו צריכים להתאים לאזור ולתחום של השריון.
לוחצים על הכרטיסייה GPUs ומבצעים את הפעולות הבאות:
- ברשימה GPU type, בוחרים את סוג ה-GPU.
- למופעי A4, בוחרים באפשרות NVIDIA B200.
- במקרים של מכונות וירטואליות מסוג A3 Ultra, בוחרים באפשרות NVIDIA H200 141GB.
- ברשימה Number of GPUs בוחרים באפשרות 8.
- אופציונלי: בוחרים סוג מכונה אחר.
- ברשימה GPU type, בוחרים את סוג ה-GPU.
בתפריט הניווט, לוחצים על מערכת הפעלה ואחסון. בחלונית מערכת הפעלה ואחסון שמופיעה, מבצעים את השלבים הבאים:
- לוחצים על Change. מופיעה החלונית דיסק אתחול עם הכרטיסייה Public images.
- ברשימת מערכת הפעלה בוחרים באפשרות Advanced Compute Images.
- ברשימה Version בוחרים את גרסת מערכת ההפעלה.
- אופציונלי: ברשימה Boot disk type, בוחרים את סוג דיסק האתחול.
- אופציונלי: מציינים מאפיינים נוספים לדיסק האתחול, כמו גודל הדיסק.
- אופציונלי: כדי לראות אפשרויות הגדרה מתקדמות, מרחיבים את הקטע Show advanced configurations.
- כדי לאשר את האפשרויות של דיסק האתחול ולחזור לחלונית מערכת ההפעלה והאחסון, לוחצים על בחירה.
בתפריט הניווט, לוחצים על Networking (רשת). החלונית Networking מופיעה.
אופציונלי: כדי להגדיר גישה למופע מחוץ ל- Google Cloud, מבצעים את השלבים הבאים:
- עוברים לקטע Firewall.
כדי לאפשר תעבורת HTTP או HTTPS למופע של Compute, בוחרים באפשרות Allow HTTP traffic או באפשרות Allow HTTPS traffic.
Compute Engine מוסיף תג רשת למכונת החישוב ויוצר את כלל חומת האש המתאים לתעבורת נתונים נכנסת, שמאפשר את כל תעבורת הנתונים הנכנסת ב-
tcp:80(HTTP) או ב-tcp:443(HTTPS). תג הרשת משייך את כלל חומת האש למופע. מידע נוסף זמין במאמר סקירה כללית של כללי חומת האש במסמכי התיעוד של Cloud Next Generation Firewall.
כדי ליצור multi-NIC, מבצעים את השלבים הבאים בחלונית Networking. אם מדובר במופע עם כרטיס רשת יחיד, מדלגים על השלבים האלה.
- בקטע Network interfaces (ממשקי רשת), מבצעים את השלבים הבאים:
- מוחקים את ממשק הרשת שמוגדר כברירת מחדל. כדי למחוק את הממשק, לוחצים על Delete.
לוחצים על Add a network interface. משתמשים באפשרות הזו כדי להוסיף ממשקי רשת שמצורפים לרשתות ה-VPC שיצרתם בקטע הקודם. כשמוסיפים את ממשקי הרשת, חשוב לזכור את הדברים הבאים:
לממשק רשת שמשמש לתקשורת בין מארחים, בוחרים רשת VPC רגילה ותת-רשת מהרשימות Network ו-Subnetwork, ומגדירים את הרשימה Network interface card ל-gVNIC.
עבור ממשק רשת שמשמש לתקשורת בין GPU ל-GPU, בוחרים את רשת ה-VPC ואת רשת המשנה של RoCE מהרשימות Network ו-Subnetwork, ומגדירים את הרשימה כרטיס רשת ל-MRDMA עבור ממשקי הרשת האלה.
בתפריט הניווט, לוחצים על מתקדם. לאחר מכן, מבצעים את השלבים הבאים בהתאם למודל ההקצאה שבו רוצים להשתמש.
Flex-start
- בקטע Provisioning model, ברשימה VM provisioning model, בוחרים באפשרות Flex-start.
בשדה Enter number of hours, מזינים את משך הזמן המקסימלי שרוצים שמכונת ה-Compute Engine תפעל. הערך חייב להיות בין
0.01(0.01 שעות, או 36 שניות) לבין168(168 שעות, או שבעה ימים).בוחרים באפשרות הגדרת זמן המתנה ליצירת מכונה וירטואלית.
בהתאם לדרישות האזוריות של עומס העבודה, מציינים את אחד משני משכי הזמן הבאים כדי להגדיל את הסיכוי שהבקשה ליצירת מכונה וירטואלית תצליח:
- עומסי עבודה עם דרישות מחמירות לגבי אזורים: אם עומס העבודה מחייב ליצור את המכונה הווירטואלית באזור ספציפי, צריך לציין משך זמן בין 90 שניות ל-שעתיים. משך זמן ארוך יותר מגדיל את הסיכוי להשיג משאבים.
- עומסי עבודה בלי דרישות מחמירות לגבי אזורים: אם אפשר להריץ את המכונה הווירטואלית בכל אזור, מציינים משך זמן של 0 שניות או מבטלים את הסימון בתיבה Set a wait time for VM creation. הפעולה הזו מציינת ש-Compute Engine יקצה משאבים רק אם הם זמינים באופן מיידי. אם הבקשה ליצירת מכונה וירטואלית נכשלת כי המשאבים לא זמינים, צריך לנסות שוב את הבקשה באזור אחר.
בשדה On VM termination, בוחרים אם לעצור או למחוק את מכונת ה-Compute בסיום משך ההפעלה שלה:
- כדי למחוק את המופע, לוחצים על מחיקה.
- כדי לעצור את המופע, לוחצים על עצירה.
הזמנה מראש
לוחצים על בחירת הזמנה. הפעולה הזו פותחת חלונית עם רשימה של הזמנות זמינות באזור שבחרתם. ברשימת ההזמנות, מבצעים את הפעולות הבאות:
- בוחרים את ההזמנה שרוצים להשתמש בה עבור מכונת החישוב. אפשר גם לבחור משבצת ספציפית בתוך ההזמנה.
- לוחצים על בחירה.
כרטיס Spot
- בקטע Provisioning model בוחרים באפשרות Spot מהרשימה VM provisioning model.
אופציונלי: כדי לבחור את פעולת הסיום שמתרחשת כש-Compute Engine מפקיע את ה-VM במודל Spot, מבצעים את השלבים הבאים:
- מרחיבים את הקטע VM provisioning model advanced settings (הגדרות מתקדמות של מודל הקצאת משאבים למכונה וירטואלית).
- ברשימה On VM termination בוחרים באחת מהאפשרויות הבאות:
- כדי לעצור את ה-VM במודל Spot במהלך ההפקעה, בוחרים באפשרות Stop (ברירת המחדל).
- כדי למחוק את ה-VM במודל Spot כשהיא מפסיקה לפני הזמן, בוחרים באפשרות Delete.
כדי ליצור את המכונה ולהפעיל אותה, לוחצים על Create.
gcloud
כדי ליצור את המכונה הווירטואלית, משתמשים
בפקודה gcloud compute instances create.
הפרמטרים שצריך לציין תלויים באפשרות הצריכה שבה אתם משתמשים לפריסה הזו. בוחרים את הכרטיסייה שמתאימה לאפשרות הצריכה שלכם.
הזמנה
לפני שמריצים את הפקודה, כדאי לעיין בכל השלבים הבאים כדי להחליט אם לכלול דגלים נוספים.
gcloud compute instances create INSTANCE_NAME \
--machine-type=MACHINE_TYPE \
--image-family=IMAGE_FAMILY \
--image-project=IMAGE_PROJECT \
--zone=ZONE \
--boot-disk-type=hyperdisk-balanced \
--boot-disk-size=DISK_SIZE \
--scopes=cloud-platform \
--network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-0,subnet=GVNIC_NAME_PREFIX-sub-0 \
--network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-1,subnet=GVNIC_NAME_PREFIX-sub-1,no-address
--network-interface=nic-type=MRDMA,network=RDMA_NAME_PREFIX-mrdma,subnet=RDMA_NAME_PREFIX-mrdma-sub-0,no-address \
--network-interface=nic-type=MRDMA,network=RDMA_NAME_PREFIX-mrdma,subnet=RDMA_NAME_PREFIX-mrdma-sub-1,no-address \
--network-interface=nic-type=MRDMA,network=RDMA_NAME_PREFIX-mrdma,subnet=RDMA_NAME_PREFIX-mrdma-sub-2,no-address \
--network-interface=nic-type=MRDMA,network=RDMA_NAME_PREFIX-mrdma,subnet=RDMA_NAME_PREFIX-mrdma-sub-3,no-address \
--network-interface=nic-type=MRDMA,network=RDMA_NAME_PREFIX-mrdma,subnet=RDMA_NAME_PREFIX-mrdma-sub-4,no-address \
--network-interface=nic-type=MRDMA,network=RDMA_NAME_PREFIX-mrdma,subnet=RDMA_NAME_PREFIX-mrdma-sub-5,no-address \
--network-interface=nic-type=MRDMA,network=RDMA_NAME_PREFIX-mrdma,subnet=RDMA_NAME_PREFIX-mrdma-sub-6,no-address \
--network-interface=nic-type=MRDMA,network=RDMA_NAME_PREFIX-mrdma,subnet=RDMA_NAME_PREFIX-mrdma-sub-7,no-address \
--reservation-affinity=specific \
--reservation=RESERVATION \
--provisioning-model=RESERVATION_BOUND \
--instance-termination-action=TERMINATION_ACTION \
--maintenance-policy=TERMINATE \
--restart-on-failure
כך עושים את זה:
-
מחליפים את מה שכתוב בשדות הבאים:
-
INSTANCE_NAME: שם ה-VM. -
MACHINE_TYPE: סוג המכונה שבה רוצים להשתמש עבור המכונה הווירטואלית. מידע נוסף זמין במאמר סוגי מכונות עם GPU במאמרי העזרה של Compute Engine. -
IMAGE_FAMILY: משפחת קובצי האימג' של קובץ האימג' של מערכת ההפעלה שבו רוצים להשתמש. רשימה של כל מערכות ההפעלה הנתמכות מופיעה במאמר מערכות הפעלה נתמכות. -
IMAGE_PROJECT: מזהה הפרויקט של תמונת מערכת ההפעלה. -
ZONE: האזור שבו סוג המכונה שרוצים להשתמש בה זמין. כדי לציין מדיניות למיקום קומפקטי, צריך להשתמש באזור שנמצא באותו אזור כמו המדיניות למיקום קומפקטי. מידע על אזורים זמין במאמר זמינות של GPU לפי אזורים ואזורי זמינות. -
DISK_SIZE: גודל דיסק האתחול ב-GB. למידע נוסף, אפשר לעיין במאמרים מגבלות הגודל של Google Cloud Hyperdisk או מגבלות הגודל של Persistent Disk, בהתאם לסוג הדיסק. -
GVNIC_NAME_PREFIX: התחילית של השם שציינתם כשיצרתם את רשתות ה-VPC הרגילות ואת רשתות המשנה שמשתמשות ב-gVNIC. -
RDMA_NAME_PREFIX: תחילית השם שציינתם כשייצרתם את רשתות ה-VPC ואת תת-הרשתות שמשתמשות בכרטיסי NIC של RDMA. -
RESERVATION: שם ההזמנה או בלוק ספציפי בהזמנה. כדי לראות את שם ההזמנה או את הבלוקים הזמינים, אפשר לעיין במאמר בנושא הצגת קיבולת מוזמנת. בהתאם לדרישות שלכם לגבי מיקום המופע, בוחרים באחת מהאפשרויות הבאות:כדי ליצור את המכונה בכל בלוק:
projects/RESERVATION_OWNER_PROJECT_ID/reservations/RESERVATION_NAME
בנוסף, כדי ליצור כמה מופעים באותו בלוק, צריך להחיל את אותה מדיניות מיקום קומפקטית שמציינת מיקום משותף של בלוק (
maxDistance=2) כשיוצרים כל מופע. Compute Engine מחיל את המדיניות על שמירת המקום ויוצר מכונות באותו בלוק.כדי ליצור את המופע בבלוק ספציפי:
projects/RESERVATION_OWNER_PROJECT_ID/reservations/RESERVATION_NAME/reservationBlocks/RESERVATION_BLOCK_NAME
TERMINATION_ACTION: אם המכונה הווירטואלית ב-Compute Engine תופסק (STOP) או תימחק (DELETE) בסיום תקופת שמירת המקום.
-
-
אופציונלי: כדי להשתמש במדיניות למיקום קומפקטי, מוסיפים את הדגל הבא:
--resource-policies=POLICY_NAME
מחליפים את מה שכתוב בשדות הבאים:
-
POLICY_NAME: השם של מדיניות המיקום הקומפקטי.
-
- מריצים את הפקודה.
Flex-start
לפני שמריצים את הפקודה, כדאי לעיין בכל השלבים הבאים כדי להחליט אם לכלול דגלים נוספים.
gcloud compute instances create INSTANCE_NAME \
--machine-type=MACHINE_TYPE \
--image-family=IMAGE_FAMILY \
--image-project=IMAGE_PROJECT \
--zone=ZONE \
--boot-disk-type=hyperdisk-balanced \
--boot-disk-size=DISK_SIZE \
--scopes=cloud-platform \
--network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-0,subnet=GVNIC_NAME_PREFIX-sub-0 \
--network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-1,subnet=GVNIC_NAME_PREFIX-sub-1,no-address
--network-interface=nic-type=MRDMA,network=RDMA_NAME_PREFIX-mrdma,subnet=RDMA_NAME_PREFIX-mrdma-sub-0,no-address \
--network-interface=nic-type=MRDMA,network=RDMA_NAME_PREFIX-mrdma,subnet=RDMA_NAME_PREFIX-mrdma-sub-1,no-address \
--network-interface=nic-type=MRDMA,network=RDMA_NAME_PREFIX-mrdma,subnet=RDMA_NAME_PREFIX-mrdma-sub-2,no-address \
--network-interface=nic-type=MRDMA,network=RDMA_NAME_PREFIX-mrdma,subnet=RDMA_NAME_PREFIX-mrdma-sub-3,no-address \
--network-interface=nic-type=MRDMA,network=RDMA_NAME_PREFIX-mrdma,subnet=RDMA_NAME_PREFIX-mrdma-sub-4,no-address \
--network-interface=nic-type=MRDMA,network=RDMA_NAME_PREFIX-mrdma,subnet=RDMA_NAME_PREFIX-mrdma-sub-5,no-address \
--network-interface=nic-type=MRDMA,network=RDMA_NAME_PREFIX-mrdma,subnet=RDMA_NAME_PREFIX-mrdma-sub-6,no-address \
--network-interface=nic-type=MRDMA,network=RDMA_NAME_PREFIX-mrdma,subnet=RDMA_NAME_PREFIX-mrdma-sub-7,no-address \
--provisioning-model=FLEX_START \
--request-valid-for-duration=REQUEST_VALID_FOR_DURATION \
--max-run-duration=MAX_RUN_DURATION \
--instance-termination-action=TERMINATION_ACTION \
--maintenance-policy=TERMINATE
כך עושים את זה:
-
מחליפים את מה שכתוב בשדות הבאים:
-
INSTANCE_NAME: שם ה-VM. -
MACHINE_TYPE: סוג המכונה שבה משתמשים למכונה הווירטואלית. מידע נוסף זמין במאמר סוגי מכונות GPU במסמכי התיעוד של Compute Engine. -
IMAGE_FAMILY: משפחת קובצי האימג' של מערכת ההפעלה שבה רוצים להשתמש. רשימה של כל מערכות ההפעלה הנתמכות מופיעה במאמר מערכות הפעלה נתמכות. -
IMAGE_PROJECT: מזהה הפרויקט של קובץ האימג' של מערכת ההפעלה. -
ZONE: האזור שבו זמין סוג המכונה שרוצים להשתמש בו. כדי לציין מדיניות למיקום קומפקטי, צריך להשתמש באזור באותו מחוז כמו המדיניות למיקום קומפקטי. מידע על אזורים זמין במאמר זמינות של GPU לפי אזורים ואזורי זמינות. -
DISK_SIZE: גודל דיסק האתחול ב-GB. למידע נוסף, קראו את המאמר מגבלות הגודל של Google Cloud Hyperdisk או את המאמר מגבלות הגודל של Persistent Disk, בהתאם לסוג הדיסק. -
GVNIC_NAME_PREFIX: תחילית השם שציינתם כשאתם יוצרים את רשתות ה-VPC הרגילות ואת רשתות המשנה שמשתמשות ב-gVNIC. -
RDMA_NAME_PREFIX: תחילית השם שציינתם כשייצרתם את רשתות ה-VPC ואת תת-הרשתות שמשתמשות בכרטיסי NIC של RDMA.
REQUEST_VALID_FOR_DURATION: משך הזמן שבו הבקשה ליצירת המכונה הווירטואלית נשארת בתוקף. הערך צריך להיות בפורמט של מספר הימים, השעות, הדקות או השניות, ואחריוd,h,mו-sבהתאמה. לדוגמה, מציינים30mל-30 דקות או1h2m3sלשעה אחת, שתי דקות ו-3 שניות.בהתאם לדרישות האזוריות של עומס העבודה, מציינים את אחד משני משכי הזמן הבאים כדי להגדיל את הסיכוי שהבקשה ליצירת מכונה וירטואלית תצליח:
- עומסי עבודה עם דרישות מחמירות לאזורים: אם עומס העבודה מחייב ליצור את ה-VM באזור ספציפי, צריך לציין משך זמן בין 90 שניות (
90s) לשעתיים (2h). ככל שמשך הזמן ארוך יותר, כך גדלים הסיכויים לקבל משאבים. - עומסי עבודה בלי דרישות מחמירות לגבי אזורים: אם אפשר להריץ את ה-VM בכל אזור, מציינים משך זמן של אפס שניות (
0s). הפעולה הזו מציינת ש-Compute Engine מקצה משאבים רק אם הם זמינים באופן מיידי. אם הבקשה ליצירת מכונה וירטואלית נכשלת כי המשאבים לא זמינים, צריך לנסות שוב את הבקשה באזור אחר.
- עומסי עבודה עם דרישות מחמירות לאזורים: אם עומס העבודה מחייב ליצור את ה-VM באזור ספציפי, צריך לציין משך זמן בין 90 שניות (
MAX_RUN_DURATION: משך הזמן שבו רוצים שהמכונות הווירטואליות המבוקשות יפעלו. צריך להגדיר את הערך כמספר הימים, השעות, הדקות או השניות, ואחריוd,h,mו-sבהתאמה. הערך צריך להיות בין 10 דקות לשבעה ימים.
TERMINATION_ACTION: מציין אם Compute Engine מפסיק (STOP) או מוחק (DELETE) את המכונה הווירטואלית בסוף משך ההפעלה שלה.
-
-
אופציונלי: כדי להשתמש במדיניות למיקום קומפקטי, מוסיפים את הדגל הבא:
--resource-policies=POLICY_NAME
מחליפים את מה שכתוב בשדות הבאים:
-
POLICY_NAME: השם של מדיניות המיקום הקומפקטי.
-
- מריצים את הפקודה.
Spot
לפני שמריצים את הפקודה, צריך לעיין בכל השלבים הבאים כדי להחליט אם לכלול דגלים נוספים.
gcloud compute instances create INSTANCE_NAME \
--machine-type=MACHINE_TYPE \
--image-family=IMAGE_FAMILY \
--image-project=IMAGE_PROJECT \
--zone=ZONE \
--boot-disk-type=hyperdisk-balanced \
--boot-disk-size=DISK_SIZE \
--scopes=cloud-platform \
--network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-0,subnet=GVNIC_NAME_PREFIX-sub-0 \
--network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-1,subnet=GVNIC_NAME_PREFIX-sub-1,no-address
--network-interface=nic-type=MRDMA,network=RDMA_NAME_PREFIX-mrdma,subnet=RDMA_NAME_PREFIX-mrdma-sub-0,no-address \
--network-interface=nic-type=MRDMA,network=RDMA_NAME_PREFIX-mrdma,subnet=RDMA_NAME_PREFIX-mrdma-sub-1,no-address \
--network-interface=nic-type=MRDMA,network=RDMA_NAME_PREFIX-mrdma,subnet=RDMA_NAME_PREFIX-mrdma-sub-2,no-address \
--network-interface=nic-type=MRDMA,network=RDMA_NAME_PREFIX-mrdma,subnet=RDMA_NAME_PREFIX-mrdma-sub-3,no-address \
--network-interface=nic-type=MRDMA,network=RDMA_NAME_PREFIX-mrdma,subnet=RDMA_NAME_PREFIX-mrdma-sub-4,no-address \
--network-interface=nic-type=MRDMA,network=RDMA_NAME_PREFIX-mrdma,subnet=RDMA_NAME_PREFIX-mrdma-sub-5,no-address \
--network-interface=nic-type=MRDMA,network=RDMA_NAME_PREFIX-mrdma,subnet=RDMA_NAME_PREFIX-mrdma-sub-6,no-address \
--network-interface=nic-type=MRDMA,network=RDMA_NAME_PREFIX-mrdma,subnet=RDMA_NAME_PREFIX-mrdma-sub-7,no-address \
--provisioning-model=SPOT \
--instance-termination-action=TERMINATION_ACTION \
--maintenance-policy=TERMINATE \
--no-restart-on-failure
כך עושים את זה:
-
מחליפים את מה שכתוב בשדות הבאים:
-
INSTANCE_NAME: שם ה-VM. -
MACHINE_TYPE: סוג המכונה שבה רוצים להשתמש עבור המכונה הווירטואלית. מידע נוסף זמין במאמר סוגי מכונות עם GPU במאמרי העזרה של Compute Engine. -
IMAGE_FAMILY: משפחת התמונות של תמונת מערכת ההפעלה שרוצים להשתמש בה. רשימה של כל מערכות ההפעלה הנתמכות מופיעה במאמר מערכות הפעלה נתמכות. -
IMAGE_PROJECT: מזהה הפרויקט של תמונת מערכת ההפעלה. -
ZONE: האזור שבו זמין סוג המכונה שרוצים להשתמש בו. כדי לציין מדיניות למיקום קומפקטי, צריך להשתמש באזור באותו מחוז כמו המדיניות למיקום קומפקטי. מידע על אזורים זמין במאמר זמינות של GPU לפי אזורים ואזורי זמינות. -
DISK_SIZE: גודל דיסק האתחול ב-GB. למידע נוסף, קראו את המאמר מגבלות הגודל של Google Cloud Hyperdisk או את המאמר מגבלות הגודל של Persistent Disk, בהתאם לסוג הדיסק. -
GVNIC_NAME_PREFIX: תחילית השם שציינתם כשאתם יוצרים את רשתות ה-VPC הרגילות ואת רשתות המשנה שמשתמשות ב-gVNIC. -
RDMA_NAME_PREFIX: תחילית השם שציינתם כשייצרתם את רשתות ה-VPC ואת תת-הרשתות שמשתמשות בכרטיסי NIC של RDMA.
TERMINATION_ACTION: הפעולה שצריך לבצע כש-Compute Engine מפקיע את המכונה,STOP(ברירת המחדל) אוDELETE.
-
-
אופציונלי: כדי להשתמש במדיניות למיקום קומפקטי, מוסיפים את הדגל הבא:
--resource-policies=POLICY_NAME
מחליפים את מה שכתוב בשדות הבאים:
-
POLICY_NAME: השם של מדיניות המיקום הקומפקטי.
-
- מריצים את הפקודה.
אחרי זמן מה, יצירת מופע המחשוב מסתיימת. כדי לוודא את הגדרות המופע ולראות את הסטטוס שלו, מריצים את הפקודה הבאה:
gcloud compute instances describe INSTANCE_NAME
הגדרת VM במודל Spot
אם יצרתם VM במודל Spot, מבצעים את השלבים הבאים:
במאמר ניהול הפסקה זמנית של VM במודל Spot מוסבר איך להכין את ה-VM במודל Spot להפסקה זמנית פוטנציאלית.
אופציונלי: מידע ולמידה על שיטות מומלצות לשימוש ב-VM במודל Spot
גישה למכונה
אחרי שיוצרים את המכונה, היא מתחילה לפעול באופן אוטומטי. כדי לגשת למופע, מבצעים אחת מהפעולות הבאות:
המסוף
נכנסים לדף VM instances במסוף Google Cloud .
לוחצים על השם של מכונת החישוב.
בקטע גישה מרחוק, לוחצים על הרשימה הנפתחת הראשונה ובוחרים איך רוצים לגשת למכונה.
מפתחות ה-SSH מועברים על ידי Compute Engine ונוצר משתמש. מידע נוסף זמין במאמר התחברות למכונות וירטואליות של Linux.
gcloud
כדי לגשת למכונה באמצעות SSH, משתמשים בפקודה gcloud compute ssh:
gcloud compute ssh INSTANCE_NAME --zone ZONE
מפתחות ה-SSH מועברים על ידי Compute Engine ונוצר משתמש. מידע נוסף זמין במאמר התחברות למכונות וירטואליות של Linux.
הסרת המשאבים
כדי להימנע מחיובים בחשבון Google Cloud על המשאבים שבהם השתמשתם במדריכים למתחילים האלה, מוחקים את כל מופעי המחשוב ואת כל המשאבים המצורפים שיצרתם.
המסוף
נכנסים לדף VM instances במסוף Google Cloud .
בוחרים את המופעים שרוצים למחוק.
לוחצים על מחיקה.
בתיבת הדו-שיח, מבצעים את הפעולות הבאות:
אופציונלי: כדי למחוק את המופעים בלי לכבות אותם בצורה מסודרת, או כדי להפסיק כיבוי מסודר שמתבצע כרגע, מסמנים את התיבה דילוג על כיבוי מסודר (אם רלוונטי).
כדי לאשר, לוחצים על מחיקה.
כדי למחוק את הדיסקים שבהם נעשה שימוש במופעים שנמחקו, עוברים לדף Disks (דיסקים) ומבצעים את השלבים הבאים:
בוחרים את הדיסקים שרוצים למחוק. לדיסקים שבוחרים לא יכול להיות ערך בעמודה In use by.
לוחצים על מחיקה.
כדי לאשר, לוחצים על מחיקה.
gcloud
כדי למחוק מכונה וירטואלית אחת או יותר באותו אזור, משתמשים בפקודה gcloud compute instances delete.
כדי לכפות את המחיקה של הדיסקים שמצורפים למופע אחד או יותר, צריך לכלול את הדגל --delete-disks:
gcloud compute instances delete INSTANCE_NAMES \
--delete-disks=DELETE_DISK_TYPE \
--zone=ZONE
מחליפים את מה שכתוב בשדות הבאים:
INSTANCE_NAMES: רשימה של שמות מופרדים ברווחים של מופעים – לדוגמה,instance-01 instance-02 instance-03.
ZONE: האזור שבו נמצאים המופעים.
DELETE_DISK_TYPE: מציינים אחד מהערכים הבאים:- כדי למחוק אחסון מתמיד מצורף של אתחול ושל לא אתחול:
all - כדי למחוק רק את האחסון המתמיד של האתחול המצורף:
boot - כדי למחוק רק אחסון מתמיד שאינו ניתן לאתחול:
data
- כדי למחוק אחסון מתמיד מצורף של אתחול ושל לא אתחול:
יצירת תמונה בהתאמה אישית על סמך Advanced Compute Images
אתם יכולים ליצור קובץ אימג' בהתאמה אישית שמבוסס על קובץ Advanced Compute Images. אחר כך תוכלו להשתמש בתמונה בהתאמה אישית כשתיצרו מכונות Compute חדשות לעומסי העבודה ולאפליקציות שלכם.
כדי ליצור תמונה בהתאמה אישית, מבצעים את הפעולות הבאות:
מגדירים מיקום אחסון לתמונה. כדי ליצור, לשנות ולמחוק קובצי אימג' של מערכות הפעלה שמאוחסנים ב-Cloud Storage, צריך לקבל את התפקיד
roles/compute.storageAdmin.יצירת מכונה של Compute Engine באמצעות Advanced Compute Images.
מתאימים אישית את מערכת ההפעלה של האורח לפי הצורך של מכונת ה-Compute Engine.
עוצרים את המכונה הווירטואלית כדי למנוע כתיבה לדיסקים. אם אי אפשר לעצור את המופע, צריך לבצע את השלבים במאמר צמצום כתיבת נתונים לדיסק אחסון מתמיד (persistent disk).
יוצרים תמונה בהתאמה אישית באמצעות דיסק האתחול של מכונת ה-Compute שלכם כדיסק המקור. אפשר לעשות זאת באמצעות מסוףGoogle Cloud או Google Cloud CLI.
המסוף
נכנסים לדף Images במסוף Google Cloud .
לוחצים על יצירת תמונה.
מציינים שם לתמונה.
בקטע Source disk, בוחרים את השם של דיסק האתחול של מכונת ה-Compute שמשתמשת ב-Advanced Compute Images.
אם המכונה לא נעצרה, בוחרים באפשרות Keep instance running כדי לאשר שרוצים ליצור את קובץ האימג' בזמן שהמכונה פועלת. כבר הייתם אמורים להשלים את השלבים לצמצום הכתיבה לדיסק האתחול.
ברשימה הנפתחת Based on source disk location (default), מציינים את המיקום שבו רוצים לאחסן את קובץ האימג' בהתאמה אישית. לדוגמה, מציינים
usכדי לאחסן את התמונהusבמספר אזורים בארה"ב, אוus-central1כדי לאחסן את התמונה המותאמת אישית באזורus-central1.אם לא תבחרו אזור, Compute Engine יאחסן את התמונה באזור המרובה הקרוב ביותר למיקום המקור של התמונה המותאמת אישית.
אופציונלי: מציינים מאפיינים אחרים לתמונה:
- משפחה: משפחת התמונות שאליה התמונה החדשה שייכת.
- תיאור: תיאור של התמונה המותאמת אישית.
- Label: תווית לקיבוץ משאבים.
מציינים את מפתח ההצפנה. אתם יכולים לבחור בין מפתחGoogle-owned and Google-managed encryption key לבין מפתח Cloud Key Management Service (Cloud KMS). אם לא מצוין מפתח הצפנה, התמונות מוצפנות באמצעות Google-owned and Google-managed encryption key.
כדי ליצור את התמונה, לוחצים על יצירה.
gcloud
משתמשים בפקודה
gcloud compute images createכדי ליצור קובץ אימג' בהתאמה אישית.הדגל
--forceהוא דגל אופציונלי שמאפשר ליצור את התמונה ממופע פעיל. כברירת מחדל, אי אפשר ליצור קובצי אימג' ממכונות פועלות. מציינים את הדגל הזה רק אם בטוחים שרוצים ליצור את התמונה בזמן שהמופע פועל.gcloud compute images create IMAGE_NAME \ --source-disk=SOURCE_DISK \ --source-disk-zone=ZONE \ [--family=IMAGE_FAMILY] \ [--storage-location=LOCATION] \ [--force]מחליפים את מה שכתוב בשדות הבאים:
-
IMAGE_NAME: שם לתמונה החדשה -
SOURCE_DISK: הדיסק שממנו רוצים ליצור את קובץ האימג' -
ZONE: האזור שבו נמצא הדיסק -
IMAGE_FAMILY: אופציונלי: דגל שמציין לאיזו משפחת קובצי אימג' שייך קובץ האימג' הזה -
LOCATION: אופציונלי: דגל שמאפשר לציין את האזור או את מספר האזורים שבהם התמונה מאוחסנת. לדוגמה, אפשר לצייןusכדי לאחסן את התמונה במספר אזוריםus, או לצייןus-central1כדי לאחסן אותה באזורus-central1. אם לא תבחרו מיקום, Compute Engine ישמור את קובץ האימג' באזור במספר אזורים שהכי קרוב למיקום המקור של קובץ האימג'.
מידע נוסף על יצירת תמונות בהתאמה אישית זמין במאמר יצירת תמונות בהתאמה אישית.
שיתוף התמונה
אחרי שיוצרים תמונה בהתאמה אישית, אפשר לשתף אותה בין פרויקטים. אם אתם מאפשרים למשתמשים מפרויקט אחר להשתמש בתמונות בהתאמה אישית, הם יכולים לגשת לתמונות האלה על ידי ציון פרויקט התמונות בבקשה שלהם.
שימוש ב-Advanced Compute Images עם תבניות של הגדרות מכונה
אתם יכולים ליצור תבנית של הגדרות מכונה שמציינת קובץ Advanced Compute Images, ואז להשתמש בתבנית כדי:
יצירת מכונות מחשוב פרטיות.
יצירת מופעי מחשוב בקבוצת מופעי מכונה מנוהלים (MIG).
יוצרים הזמנות למכונות וירטואליות.
מגבלות על יצירת תבניות של הגדרות מכונה
חשוב לשים לב למגבלות הבאות כשיוצרים תבנית של הגדרות מכונה:
- אפשר להשתמש ב-VPC משותף בממשקים שהם לא
nic0לתבניות של הגדרות מכונה ב-CLI של gcloud וב-REST, אבל לא במסוףGoogle Cloud . - אי אפשר לעדכן תבנית של הגדרות מכונה קיימת או לשנות תבנית של הגדרות מכונה אחרי שהיא נוצרה. אם תבנית של הגדרות מכונה לא עדכנית או שצריך לשנות את ההגדרות, יוצרים תבנית חדשה.
- אם רוצים לציין משפחת תמונות בתבנית של הגדרות מכונה, אי אפשר להשתמש במסוף Google Cloud . במקום זאת, אפשר להשתמש ב-Google Cloud CLI או ב-REST.
- אם רוצים לציין דיסקים אזוריים במקום דיסקים אזוריים בתבנית של מכונה, אי אפשר להשתמש במסוף Google Cloud . במקום זאת, אפשר להשתמש ב-Google Cloud CLI או ב-REST.
- אפשר להשתמש בתבנית של הגדרות מכונה כדי ליצור מכונות עם דיסק אתחול של Hyperdisk Balanced שנמצא בStorage Pool, אבל רק אם ה-Storage Pool נמצא באותו תחום (zone) כמו המכונה.
- אי אפשר להשתמש בתבניות של הגדרות מכונה גלובליות כדי ליצור מכונות עם דיסקים שאינם דיסקי אתחול שנמצאים ב-Storage Pool.
- כדי ליצור תבנית של הגדרות מכונה אזורית, סוג ה-GPU שאתם מציינים בתבנית צריך להיות זמין לפחות בתחום (zone) אחד באזור שצוין.
יצירת תבנית של הגדרות מכונה
אפשר לציין בתבנית של הגדרות מכונה את רוב מאפייני המכונה שאפשר לציין בבקשה ליצירת מכונה נפרדת, כולל מטא-נתונים של מכונה, סקריפטים לטעינה בזמן ההפעלה, דיסקים אחסון מתמידים (persistent disk) וחשבונות שירות. המידע שחובה לציין בתבנית של הגדרות מכונה כולל את סוג המכונה, דיסק האתחול והרשת.
אפשר ליצור תבנית של הגדרות מכונה אזורית או גלובלית שמשתמשת ב-Advanced Compute Images באמצעות מסוף Google Cloud או Google Cloud CLI.
כדי ליצור תבנית של הגדרות מכונה, לחשבון המשתמש שלכם צריכות להיות כל ההרשאות שנדרשות להפעלת ה-method instanceTemplates.insert.
בקטעים הבאים מוסבר איך ליצור תבנית של הגדרות מכונה לשימוש עם קבוצות מופעי מכונה מנוהלים (MIG), מכונות Compute נפרדות או מקומות שמורים. כדי ליצור תבנית של הגדרות מכונה לשימוש עם AI Hypercomputer, צריך לפעול לפי ההוראות במאמר יצירת קבוצת מכונות מנוהלת (MIG) שעברה אופטימיזציה ל-AI עם סוג מכונה A4 או A3 Ultra.
יצירת משאבים נוספים שנדרשים למופעי A3 ultra או A4
לפני שיוצרים תבנית של הגדרות מכונה למכונות שמשתמשות ב-Advanced Compute Images, צריך קודם ליצור את המשאבים שתציינו בתבנית של הגדרות המכונה. כדי ליצור את המשאבים האלה, צריך להשלים את המשימות שמפורטות בקטע דרישות מוקדמות.
יצירת תבנית של הגדרות מכונה שמציינת תמונה של Advanced Compute Images
אפשר ליצור את תבנית של הגדרות מכונה באמצעות Google Cloud המסוף או פקודות של ה-CLI של gcloud.
המסוף
נכנסים לדף Instance templates במסוף Google Cloud .
לוחצים על יצירת תבנית של הגדרות מכונה.
בשדה Name, מזינים שם לתבנית של הגדרות מכונה.
בוחרים את המיקום באופן הבא:
- כדי להשתמש בתבנית של הגדרות מכונה באזורים שונים, בוחרים באפשרות Global (ברירת מחדל).
- כדי לצמצם את התלות בין אזורים, בוחרים באפשרות אזורי ואז בוחרים את האזור שבו רוצים ליצור את תבנית של הגדרות מכונה.
בקטע Machine configuration מבצעים את הפעולות הבאות:
- לוחצים על הכרטיסייה GPUs.
- ברשימה GPU type, בוחרים את סוג ה-GPU. במכונות A4, בוחרים באפשרות
NVIDIA B200, ובמכונות A3 Ultra בוחרים באפשרותNVIDIA H200 141GB. - ברשימה Number of GPUs, בוחרים באפשרות 8.
- אופציונלי: בוחרים סוג מכונה שונה מברירת המחדל.
בקטע Boot disk (דיסק אתחול), לוחצים על Change (שינוי) ומבצעים את הפעולות הבאות:
- ברשימה מערכת הפעלה, בוחרים באפשרות Advanced Compute Images.
- ברשימה Version, בוחרים את גרסת מערכת ההפעלה.
- אופציונלי: מציינים מאפיינים נוספים לדיסק האתחול, כמו גודל הדיסק.
לוחצים על Create כדי ליצור את התבנית של הגדרות המכונה.
gcloud
כדי ליצור תבנית של הגדרות מכונה אזורית או גלובלית, משתמשים בפקודה instance-templates create.
כדי להגדיר את האזור של תבנית של הגדרות מכונה אזורית, צריך להשתמש בדגל --instance-template-region.
כשיוצרים תבנית של הגדרות מכונה למכונות GPU, צריך להגדיר את האפשרות --maintenance-policy לערך TERMINATE.
יוצרים תבנית של הגדרות מכונה אזורית באמצעות הפקודה הבאה.
gcloud compute instance-templates create INSTANCE_TEMPLATE_NAME \ --instance-template-region=REGION \ --accelerator=count=8,type=GPU_TYPE \ --machine-type=MACHINE_TYPE \ --image-project=advanced-compute-images \ --image-family=IMAGE_FAMILY \ --maintenance-policy=TERMINATE
יוצרים תבנית גלובלית של הגדרות מכונה באמצעות הפקודה הבאה:
gcloud compute instance-templates create INSTANCE_TEMPLATE_NAME --accelerator=count=8,type=GPU_TYPE \ --machine-type=MACHINE_TYPE \ --image-project=advanced-compute-images \ --image-family=IMAGE_FAMILY \ --maintenance-policy=TERMINATE
מחליפים את מה שכתוב בשדות הבאים:
- INSTANCE_TEMPLATE_NAME: שם לתבנית של הגדרות המכונה.
- REGION: בתבניות של הגדרות מכונה אזוריות, זהו האזור שבו התבנית נוצרת.
- GPU_TYPE: סוג ה-GPU שבו משתמשים במכונות המחשוב.
כשמשתמשים ב-Advanced Compute Images, צריך לציין
nvidia-b200עבור מכונות וירטואליות מסוג A4 אוnvidia-h200-141gbעבור מכונות וירטואליות מסוג A3 Ultra. - MACHINE_TYPE: סוג המכונה של מופע ה-Compute. כדי להשתמש ב-Advanced Compute Images, צריך לציין סוג מכונה A3 Ultra או A4.
- IMAGE_FAMILY: מציינים אחת מהאפשרויות הבאות:
- IMAGE_FAMILY: משפחה של תמונות. הערך הזה מציין את גרסת תמונת מערכת ההפעלה העדכנית ביותר באותה משפחה. לדוגמה, אפשר לציין
aci-gpu-u2204-slurm-2511-cuda-130-nvidia-580-amd64. - IMAGE: גרסה ספציפית של קובץ האימג' של מערכת ההפעלה, לדוגמה
aci-gpu-u2204-slurm-2511-cuda-130-nvidia-580-amd64-v20260427-1. כדי לציין גרסה ספציפית של קובץ אימג' של מערכת ההפעלה במקום משפחת תמונות, צריך להשתמש בדגל--imageבמקום בדגל--image-family.
- IMAGE_FAMILY: משפחה של תמונות. הערך הזה מציין את גרסת תמונת מערכת ההפעלה העדכנית ביותר באותה משפחה. לדוגמה, אפשר לציין
אפשר להוסיף עד 15 דיסקים משניים שאינם דיסקים לאתחול. מציינים את הדגל --create-disk לכל דיסק משני שיוצרים.
- כדי ליצור דיסקים משניים מתמונה ציבורית או מתמונה בהתאמה אישית, מציינים את המאפיינים
imageו-image-projectלכל דיסק בדגל--create-disk. - כדי ליצור דיסק ריק, לא כוללים את המאפיינים
imageאוimage-project - אפשר גם לכלול מאפיינים לדיסק
sizeו-type.
רשימה של כל פקודות המשנה והדגלים הזמינים מופיעה בחומר העזר בנושא instance-templates.
המאמרים הבאים
* כדאי לעיין בתרחישים בסיסיים ליצירת קבוצות של מופעי מכונה מנוהלים (MIG). * כך בודקים את הסטטוס של מכונה כדי לדעת מתי היא מוכנה לשימוש. * איך מתחברים למכונה