צריך לפרוס את משאבי החיזוי המותאמים אישית באשכול החיזוי שנוצר בשבילכם על ידי מפעיל התשתית (IO). המפעיל יוצר עומסי עבודה של תחזיות באותו אשכול.
כדי ליצור את אשכול החיזוי, צריך לעבוד עם ה-IO כדי לשייך את פרויקט החיזוי ולהקצות את מאגרי הצמתים שנדרשים לחיזויים אונליין ב-Google Distributed Cloud (GDC) עם בידוד פיזי.
כדי ליצור אשכול חיזוי:
מזהים את הפרויקט בארגון שרוצים לשייך אליו את האשכול החדש לתחזיות אונליין.
הוראות ליצירת פרויקט מופיעות במאמר הגדרת פרויקט ל-Vertex AI. צריך את מזהה הפרויקט כשמבצעים קריאות ל-API.
מתוך רשימת סוגי המכונות הזמינים ב-Distributed Cloud, בוחרים את סוג המכונה עבור הצמתים שנדרשים לעומסי העבודה באשכול.
סוג המכונה שתבחרו תלוי בגודל ובמורכבות של מודל החיזוי שלכם, והוא קובע את משאבי המחשוב ויחידת העיבוד הגרפי (GPU) ש-IO מספק לאשכול. כשבוחרים את סוג המכונה לצמתים, כדאי לפעול לפי ההמלצות לבחירת צמתים.
שולחים אימייל עם בקשה ליצירת האשכול באמצעות תבנית של בקשה ליצירת אשכול לחיזוי.
במקרה הצורך, מתקשרים עם ה-IO עד שהוא מסיים ליצור את אשכול החיזוי שמשויך לפרויקט שלכם ולהקצות את מאגרי הצמתים המתאימים באשכול.
אחרי השלמת הקצאת האשכול, אשכול החיזוי מוכן לחיזויים אונליין.
המלצות לבחירת צמתים
כשממשק ה-IO יוצר מאגרי צמתים באשכול, הוא מקצה אחד מסוגי המכונות הזמינים ב-Distributed Cloud כדי לספק קבוצה מוגדרת מראש של משאבים לצמתי העובדים. בהתאם לגודל ולמורכבות של המודל, נדרשים ביצועי מחשוב שונים, ולכן כמות ספציפית של CPU, זיכרון ו-GPU. כדי ליצור אשכול חיזוי, צריך לספק את הפרטים האלה בתקשורת עם ה-IO.
כשמגדירים באמצעות ה-IO את סוג המכונה למאגרי הצמתים שנדרשים באשכול החיזוי, צריך לפעול בהתאם לשיטות המומלצות הבאות:
- ב-Distributed Cloud, יש תקורה של מחשוב בצמתים עבור רכיבי מערכת חובה. לכן, אתם צריכים לבחור סוג מכונה גדול יותר למאגרי הצמתים מאשר הסוג שאתם מתכוונים להשתמש בו במאגר המשאבים של המודלים.
- בוחרים את הפתרון שמספק את הזיכרון ומשאבי המחשוב המינימליים שנדרשים לצרכים שלכם. לדוגמה, אם המודל שלכם דורש שמונה ליבות vCPU, צריך לבחור את סוג המכונה
n2-highcpu-8-gdc, הפתרון הקטן ביותר עם שמונה ליבות vCPU ו-8 GB של זיכרון ב-Distributed Cloud. - ככל שמתקדמים, כדאי לשקול פתרונות עם ביצועים טובים יותר רק אם פתרונות קטנים יותר לא מתאימים לצרכים שלכם ולגודל ולמורכבות של המודל. חשוב מאוד להקפיד על העיקרון של הרשאות מינימליות, ולהשתמש רק במשאבים שדרושים לכם כדי להפעיל את תהליך העבודה הספציפי שלכם. הגישה האחראית הזו מבטיחה שימוש מושכל במשאבים בסביבת Distributed Cloud.
- כדאי לבחור רק פתרונות עם מעבדי GPU אם אתם צריכים אותם בשביל המודל שלכם.
- אם המודל שלכם דורש יחידות GPU, כדאי לשקול את
a2-highgpu-1g-gdcסוג המכונה, הפתרון הקטן ביותר שמספק יחידות GPU.
תבנית של תרחיש לדוגמה של אשכול חיזוי
אפשר להשתמש בתבנית הבאה כדי לשלוח אימייל ל-IO. האימייל פותח קייס כדי ליצור את אשכול החיזוי שדרוש לחיזויים אונליין.
Good day,
I need to create a prediction cluster and associate it with a project in my organization to use online predictions.
Please use the following information for the creation of the cluster:
- **Cluster name:** vtx-ai-prediction
- **Name of the organization:** [Specify your organization's name.]
- **Project name:** [Specify the name of your project to associate with the prediction cluster.]
- **Machine type for the node pool:** [Specify the machine type you chose from the list of available machine types for the cluster nodes based on node selection recommendations. Please note that the IO can respond with a different suggestion based on your needs.]
- **Compute resources:** [Optionally, if you know how many compute resources your workloads need, describe them in this field.]
- **Memory resources:** [Optionally, if you know how many memory resources your workloads need, describe them in this field.]
- **GPU resources:** [Optionally, if you know how many GPU resources your workloads need, describe them in this field.]
**Note for IO:** Review the instructions to create the prediction cluster in the following section of the documentation: Operator > Configure the deployment > Create the Prediction cluster
Thank you,
[Your name]