כברירת מחדל, Cloud Run עובר אופטימיזציה לביצועים גבוהים עם יעד ניצול של 60% גם למעבד (CPU) וגם לשימוש בו-זמני, ומשנה את מספר המכונות באופן אוטומטי כדי לטפל בכל הבקשות הנכנסות. עם זאת, בתרחישי שימוש מסוימים, יכול להיות שתרצו להגדיר אילו גורמי קנה מידה ישמשו, למשל רק CPU, ולהגדיר יעדים מותאמים אישית לניצול.
Cloud Run מספק אמצעי בקרה על שינוי הגודל, כדי לתת לכם יותר שליטה על התנהגויות שינוי הגודל של השירות, וכך מאפשר לכם לקבל החלטות מושכלות לגבי שינוי הגודל של עומס העבודה בהתאם לדרישות שלכם. אפשר להגדיר את יעדי הניצול המותאמים אישית הבאים:
- ניצול יעד להרחבת קנה מידה מבוססת-CPU
- ניצול יעד להרחבת היקף הפעילות על סמך מספר החיבורים בו-זמנית
אמצעי הבקרה של ההתאמה לגודל מאפשרים לכם לבצע אופטימיזציה של העלויות ולשפר את יכולת החיזוי של השירותים. מידע נוסף על התנהגות ברירת המחדל של שינוי גודל אוטומטי בשירותי Cloud Run זמין במאמר מידע על שינוי גודל אוטומטי של מופעים בשירותי Cloud Run.
מגבלות על הגדרות אישיות
המגבלות הבאות חלות על יעדי שינוי גודל בהתאמה אישית:
| גורם שמשפיע על התאמה לעומס | אחוז ברירת המחדל | אחוז מינימלי שניתן להגדרה | אחוז מקסימלי שניתן להגדרה |
|---|---|---|---|
CPU target utilization |
60% | 10% | 90% |
Concurrency target utilization |
60% | 10% | 95% |
הגדרת יעדים בהתאמה אישית
אתם יכולים להגדיר יעדי ניצול בהתאמה אישית כדי לבצע אופטימיזציה של העלויות או לשפר את הביצועים של עומסי העבודה. לשם כך, צריך להגדיר יעדי ניצול ספציפיים של CPU ושל פעולות בו-זמניות במסגרת מגבלות ההגדרה.
כל שינוי בהגדרות מוביל ליצירה של גרסה חדשה. גם גרסאות מאוחרות יותר יקבלו אוטומטית את הגדרת התצורה הזו, אלא אם תבצעו עדכונים מפורשים כדי לשנות אותה.
גם אם מגדירים יעדי מקבילות מותאמים אישית או משביתים את ההתאמה של קנה המידה לפי מעבד, התכונה 'התאמה דינמית של מקבילות' (ACT) נשארת פעילה. פרטים נוספים זמינים במאמר מידע על שינוי אוטומטי של גודל המכונה.
אפשר להגדיר את אמצעי הבקרה של שינוי הגודל באמצעות מסוף Google Cloud , ה-CLI של gcloud, YAML או Terraform כשפורסים גרסה חדשה.
המסוף
נכנסים לדף Services של Cloud Run במסוף Google Cloud :
אם אתם מגדירים שירות חדש, לוחצים על Deploy container (פריסת מאגר) כדי להציג את הדף Create service (יצירת שירות).
אם מגדירים שירות קיים, לוחצים על השירות כדי לפתוח את הדף פרטי השירות, ואז לוחצים על הכרטיסייה שינוי גודל.
מאתרים את הקטע Service scaling (שינוי קנה מידה של שירות). מוודאים שהאפשרות שינוי גודל אוטומטי נבחרה. מרחיבים את הקטע התאמה אישית של גורמי שינוי הגודל האוטומטי כדי להגדיר את יעדי הניצול הבאים:
כדי להגדיר את יעד ניצול ה-CPU, לוחצים על ניצול ה-CPU ומזינים ערך מ-
10עד90.כדי להגדיר את ניצול המקבילות של היעד, לוחצים על ניצול בקשות מקבילות ומזינים ערך מ-
10עד95.לוחצים על סיום מתחת לכל הגדרת ניצול.
לוחצים על יצירה כדי ליצור שירות חדש. לוחצים על הצגת ההשוואה ופריסה מחדש ואז על פריסת שינויים בשירות קיים.
gcloud
כדי לעדכן את הערכים של ניצול היעד של CPU וניצול היעד של פעולות בו-זמניות של עדכון נתון, מריצים את הפקודה gcloud run services update.
כדי לעדכן את יעד ניצול המעבד, מריצים את הפקודה הבאה:
gcloud run services update SERVICE --scaling-cpu-target=CPU_TARGET
מחליפים את מה שכתוב בשדות הבאים:
SERVICE: השם של השירות.
CPU_TARGET: היעד לניצול המעבד. מציינים ערך בין
0.1ל-0.90. אפשר להגדיר עד שתי ספרות אחרי הנקודה העשרונית.
כדי לעדכן את יעד הניצול של הפעלה מקבילה, מריצים את הפקודה הבאה:
gcloud run services update SERVICE --scaling-concurrency-target=CONCURRENCY_TARGET
מחליפים את מה שכתוב בשדות הבאים:
SERVICE: השם של השירות.
CONCURRENCY_TARGET: היעד לניצול של מקביליות. מציינים ערך מ-`0.1` עד `0.95`. אפשר להגדיר עד שתי ספרות אחרי הנקודה העשרונית.
כדי לעדכן גם את יעד השימוש במעבד וגם את יעד השימוש במקביליות, מריצים את הפקודה הבאה:
gcloud run services update SERVICE --scaling-cpu-target=CPU_TARGET \ --scaling-concurrency-target=CONCURRENCY_TARGET
מחליפים את מה שכתוב בשדות הבאים:
- SERVICE: השם של השירות.
- CPU_TARGET: היעד לניצול המעבד. מציינים ערך
בין
0.1ל-0.90. אפשר להגדיר עד שתי ספרות אחרי הנקודה העשרונית. - CONCURRENCY_TARGET: היעד לניצול של מקביליות. מציינים ערך מ-`0.1` עד `0.95`. אפשר להגדיר עד שתי ספרות אחרי הנקודה העשרונית.
YAML
אם אתם יוצרים שירות חדש, דלגו על השלב הזה. אם אתם מעדכנים שירות קיים, אתם צריכים להוריד את הגדרות ה-YAML שלו:
gcloud run services describe SERVICE --format export > service.yaml
כדי לעדכן את יעד השימוש במעבד ואת יעד השימוש במקביל, מוסיפים את המאפיינים
run.googleapis.com/scaling-cpu-targetו-run.googleapis.com/scaling-concurrency-target:apiVersion: serving.knative.dev/v1 kind: Service metadata: name: SERVICE spec: template: metadata: annotations: run.googleapis.com/scaling-cpu-target: 'CPU_TARGET' run.googleapis.com/scaling-concurrency-target: 'CONCURRENCY_TARGET'
מחליפים את מה שכתוב בשדות הבאים:
- SERVICE: השם של השירות.
- CPU_TARGET: היעד לניצול המעבד. מציינים ערך
בין
0.1ל-0.90. אפשר להגדיר עד שתי ספרות אחרי הנקודה העשרונית. - CONCURRENCY_TARGET: היעד לניצול של מקביליות. מציינים ערך מ-`0.1` עד `0.95`. אפשר להגדיר עד שתי ספרות אחרי הנקודה העשרונית.
יוצרים או מעדכנים את השירות באמצעות הפקודה הבאה:
gcloud run services replace service.yaml
אם קיים קובץ
service.yaml, הפקודהgcloud run services replaceמשתמשת בו כברירת מחדל.
Terraform
כדי ללמוד איך להחיל הגדרות ב-Terraform או להסיר אותן, ראו פקודות בסיסיות ב-Terraform.
מוסיפים את השורות הבאות למשאבgoogle_cloud_run_v2_service בתצורת Terraform:resource "google_cloud_run_v2_service" "default" {
name = "SERVICE"
location = "REGION"
template {
scaling {
cpu_utilization = CPU_TARGET
concurrency_utilization = CONCURRENCY_TARGET
}
containers {
image = "IMAGE_URL"
}
}
}
מחליפים את מה שכתוב בשדות הבאים:
- SERVICE: השם של השירות.
- REGION: האזור Google Cloud , למשל
europe-west1. - CPU_TARGET: היעד לניצול המעבד. מציינים ערך
בין
0.1ל-0.90. אפשר להגדיר עד שתי ספרות אחרי הנקודה העשרונית. - CONCURRENCY_TARGET: היעד לניצול של מקביליות. מציינים ערך מ-`0.1` עד `0.95`. אפשר להגדיר עד שתי ספרות אחרי הנקודה העשרונית.
-
IMAGE_URL: הפניה לקובץ אימג' בקונטיינר, לדוגמה,us-docker.pkg.dev/cloudrun/container/hello:latest. אם אתם משתמשים ב-Artifact Registry, צריך ליצור מראש את המאגר REPO_NAME. כתובת ה-URL היא בפורמטLOCATION-docker.pkg.dev/PROJECT_ID/REPO_NAME/PATH:TAG
השבתת אמצעי הבקרה של שינוי הגודל
אפשר להשבית את היעדים של ניצול המעבד או של ניצול המקביליות, אבל לא את שניהם. תמיד צריך להיות פעיל מנוע אחד להרחבת הפעילות. כדי לבטל את ההסכמה לשימוש באמצעי הבקרה של שינוי הגודל, משחזרים את ערכי ברירת המחדל של הניצול במקום להשבית אותם. כשמשביתים גורם מניע להרחבה, Cloud Run מתעלם מהמדד הזה כשמתקבלות החלטות לגבי הרחבה.
אפשר להשבית את אמצעי הבקרה של שינוי הגודל באמצעות Google Cloud המסוף, ה-CLI של gcloud, YAML או Terraform כשפורסים גרסה חדשה.
המסוף
נכנסים לדף Services של Cloud Run במסוף Google Cloud :
לוחצים על השירות כדי לפתוח את הדף פרטי השירות, ואז לוחצים על הכרטיסייה התאמה.
מאתרים את הקטע Service scaling (שינוי קנה מידה של שירות). מוודאים שהאפשרות שינוי גודל אוטומטי נבחרה. מרחיבים את הקטע התאמה אישית של גורמי שינוי הגודל האוטומטי:
כדי לשנות את קנה המידה רק לפי CPU, לוחצים על סמל המחיקה לצד Concurrent request utilization (ניצול בקשות בו-זמניות) ומזינים ערך לניצול CPU היעד אם הוא חסר.
כדי לשנות את קנה המידה רק לפי מקביליות, לוחצים על סמל המחיקה לצד ניצול CPU ומזינים ערך לניצול המקביליות של היעד אם הוא חסר.
לוחצים על סיום מתחת לכל הגדרת ניצול.
לוחצים על יצירה כדי ליצור שירות חדש. לוחצים על הצגת ההשוואה ופריסה מחדש ואז על פריסת שינויים בשירות קיים.
gcloud
כדי להשבית את יעד ניצול המעבד או את יעד ניצול המקביליות, מריצים את הפקודה gcloud run services update.
כדי להגדיל את הקיבולת רק לפי CPU, משביתים את יעד המקבילות על ידי הרצת הפקודה הבאה:
gcloud run services update SERVICE --scaling-concurrency-target=disabled
מחליפים את SERVICE בשם השירות.
כדי להגדיל את הקיבולת רק לפי מספר הבקשות בו-זמנית, משביתים את יעד השימוש במעבד באמצעות הפקודה הבאה:
gcloud run services update SERVICE --scaling-cpu-target=disabled
מחליפים את SERVICE בשם השירות.
YAML
אם אתם יוצרים שירות חדש, דלגו על השלב הזה. אם אתם מעדכנים שירות קיים, אתם צריכים להוריד את הגדרות ה-YAML שלו:
gcloud run services describe SERVICE --format export > service.yaml
כדי להגדיל את הקיבולת רק לפי CPU, משביתים את יעד המקביליות על ידי הגדרת המאפיין
run.googleapis.com/scaling-concurrency-targetלערךdisabled:apiVersion: serving.knative.dev/v1 kind: Service metadata: name: SERVICE spec: template: metadata: annotations: run.googleapis.com/scaling-concurrency-target: disabled
מחליפים את SERVICE בשם השירות.
כדי להגדיל את הקיבולת רק לפי מספר הבקשות בו-זמנית, משביתים את יעד ה-CPU על ידי הגדרת המאפיין
run.googleapis.com/scaling-cpu-targetלערךdisabled:apiVersion: serving.knative.dev/v1 kind: Service metadata: name: SERVICE spec: template: metadata: annotations: run.googleapis.com/scaling-cpu-target: disabled
מחליפים את SERVICE בשם השירות.
יוצרים או מעדכנים את השירות באמצעות הפקודה הבאה:
gcloud run services replace service.yaml
אם קיים קובץ
service.yaml, הפקודהgcloud run services replaceמשתמשת בו כברירת מחדל.
Terraform
כדי ללמוד איך להחיל הגדרות ב-Terraform או להסיר אותן, ראו פקודות בסיסיות ב-Terraform.
מוסיפים את הטקסט הבא למשאבgoogle_cloud_run_v2_service בקובץ התצורה של Terraform:כדי להגדיל את הקיבולת רק לפי מעבד, משביתים את יעד המקביליות על ידי הגדרת
concurrency_utilizationל-0:resource "google_cloud_run_v2_service" "default" { name = "SERVICE" location = "REGION" template { scaling { cpu_utilization = CPU_TARGET concurrency_utilization = 0 } containers { image = "IMAGE_URL" } } }מחליפים את מה שכתוב בשדות הבאים:
- SERVICE: השם של השירות.
- REGION: האזור Google Cloud , למשל
europe-west1. - CPU_TARGET: היעד לניצול המעבד. מציינים ערך
בין
0.1ל-0.90. אפשר להגדיר עד שתי ספרות אחרי הנקודה העשרונית. -
IMAGE_URL: הפניה לקובץ אימג' בקונטיינר, לדוגמה,us-docker.pkg.dev/cloudrun/container/hello:latest. אם אתם משתמשים ב-Artifact Registry, צריך ליצור מראש את המאגר REPO_NAME. כתובת ה-URL היא בפורמטLOCATION-docker.pkg.dev/PROJECT_ID/REPO_NAME/PATH:TAG
כדי להגדיל את הקיבולת רק לפי מספר הבקשות המקבילות, משביתים את יעד המעבד על ידי הגדרת
cpu_utilizationלערך0:resource "google_cloud_run_v2_service" "default" { name = "SERVICE" location = "REGION" template { scaling { cpu_utilization = 0 concurrency_utilization = CONCURRENCY_TARGET } containers { image = "IMAGE_URL" } } }מחליפים את מה שכתוב בשדות הבאים:
- SERVICE: השם של השירות.
- REGION: האזור Google Cloud , למשל
europe-west1. - CONCURRENCY_TARGET: היעד לניצול של מקביליות. מציינים ערך מ-`0.1` עד `0.95`. אפשר להגדיר עד שתי ספרות אחרי הנקודה העשרונית.
-
IMAGE_URL: הפניה לקובץ אימג' בקונטיינר, לדוגמה,us-docker.pkg.dev/cloudrun/container/hello:latest. אם אתם משתמשים ב-Artifact Registry, צריך ליצור מראש את המאגר REPO_NAME. כתובת ה-URL היא בפורמטLOCATION-docker.pkg.dev/PROJECT_ID/REPO_NAME/PATH:TAG
שחזור לערכי ברירת המחדל
כשמשחזרים את ערכי יעד השימוש במעבד או את ערכי יעד השימוש המקביל לברירת המחדל, Cloud Run משתמש ביעד השימוש המקביל של ברירת המחדל, שהוא 60%, במקום ביעדים המותאמים אישית שהגדרתם. אפשר לשחזר את הגדרות בקרת שינוי הגודל לברירת המחדל באמצעות המסוף Google Cloud , ה-CLI של gcloud, YAML או Terraform כשפורסים גרסה חדשה.
המסוף
נכנסים לדף Services של Cloud Run במסוף Google Cloud :
לוחצים על השירות כדי לפתוח את הדף פרטי השירות, ואז לוחצים על הכרטיסייה התאמה.
מאתרים את הקטע Service scaling (שינוי קנה מידה של שירות). מוודאים שהאפשרות שינוי גודל אוטומטי נבחרה. מרחיבים את הקטע התאמה אישית של גורמי שינוי הגודל האוטומטי כדי להגדיר את יעדי הניצול הבאים:
אם היעדים CPU utilization ו-Concurrent request utilization הוסרו, לוחצים על Add a signal כדי להוסיף אותם מחדש.
מגדירים את הערכים של CPU utilization (ניצול CPU) ו-Concurrent request utilization (ניצול בקשות מקבילות) ל-
60.לוחצים על סיום מתחת לכל הגדרת ניצול.
לוחצים על יצירה כדי ליצור שירות חדש. לוחצים על הצגת ההשוואה ופריסה מחדש ואז על פריסת שינויים בשירות קיים.
gcloud
כדי לשחזר את ניצול המעבד (CPU) של היעד ואת ניצול המקביליות של היעד לערכי ברירת המחדל שלהם, מריצים את הפקודה gcloud run services update.
כדי לשחזר את יעד ניצול המעבד לערך ברירת המחדל, מריצים את הפקודה הבאה:
gcloud run services update SERVICE --scaling-cpu-target=default
מחליפים את SERVICE בשם השירות.
כדי לשחזר את ערך ברירת המחדל של ניצול המקבילות של היעד, מריצים את הפקודה הבאה:
gcloud run services update SERVICE --scaling-concurrency-target=default
מחליפים את SERVICE בשם השירות.
כדי לשחזר את יעד ניצול המעבד ואת יעד הפעולות המקבילות לערכי ברירת המחדל שלהם, מריצים את הפקודה הבאה:
gcloud run services update SERVICE --scaling-cpu-target=default \ --scaling-concurrency-target=default
מחליפים את SERVICE בשם השירות.
YAML
אם אתם יוצרים שירות חדש, דלגו על השלב הזה. אם אתם מעדכנים שירות קיים, אתם צריכים להוריד את הגדרות ה-YAML שלו:
gcloud run services describe SERVICE --format export > service.yaml
כדי לשחזר את השימוש במעבד ובבו-זמניות לערכי ברירת המחדל, מסירים את המאפיינים
run.googleapis.com/scaling-cpu-targetו-run.googleapis.com/scaling-concurrency-targetמקובץ ה-YAML:apiVersion: serving.knative.dev/v1 kind: Service metadata: name: SERVICE spec: template: metadata: # Remove the scaling target annotations to restore defaults ...
מחליפים את SERVICE בשם השירות.
יוצרים או מעדכנים את השירות באמצעות הפקודה הבאה:
gcloud run services replace service.yaml
אם קיים קובץ
service.yaml, הפקודהgcloud run services replaceמשתמשת בו כברירת מחדל.
Terraform
כדי ללמוד איך להחיל הגדרות ב-Terraform או להסיר אותן, ראו פקודות בסיסיות ב-Terraform.
מוסיפים את השורות הבאות למשאבgoogle_cloud_run_v2_service בתצורת Terraform:כדי לשחזר את יעדי ברירת המחדל של ניצול ה-CPU והבו-זמניות, מסירים את המאפיינים cpu_utilization ו-concurrency_utilization מהבלוק scaling בהגדרות Terraform:
resource "google_cloud_run_v2_service" "default" {
name = "SERVICE"
location = "REGION"
template {
scaling {
# Remove the scaling target attributes to restore defaults
}
containers {
image = "IMAGE_URL"
}
}
}
מחליפים את מה שכתוב בשדות הבאים:
- SERVICE: השם של השירות.
- REGION: האזור Google Cloud , למשל
europe-west1. -
IMAGE_URL: הפניה לקובץ אימג' בקונטיינר, לדוגמה,us-docker.pkg.dev/cloudrun/container/hello:latest. אם אתם משתמשים ב-Artifact Registry, צריך ליצור מראש את המאגר REPO_NAME. כתובת ה-URL היא בפורמטLOCATION-docker.pkg.dev/PROJECT_ID/REPO_NAME/PATH:TAG
צפייה בהגדרות של שינוי הגודל
אפשר לראות את הגדרות ההרחבה באמצעות ה Google Cloud מסוף או ה-CLI של gcloud.
המסוף
נכנסים לדף Services של Cloud Run במסוף Google Cloud :
לוחצים על השירות כדי לפתוח את החלונית פרטי השירות.
לוחצים על הכרטיסייה שינוי גודל כדי לראות את הגדרות שינוי הגודל.
gcloud
משתמשים בפקודה הבאה:
gcloud run services describe SERVICE
מחליפים את SERVICE בשם השירות.
מחפשים את הערך של ההגדרות Target CPU utilization: (ניצול יעד של CPU) ו-Target concurrency utilization: (ניצול יעד של פעולות בו-זמניות) בתצורה שהוחזרה.
שיטות מומלצות
כדי לייעל את העלויות ולמנוע הרחבה מוגזמת, אפשר להקטין את מספר המופעים. כדי לשפר את הביצועים, אפשר להרחיב את המשאבים בצורה אגרסיבית יותר בתגובה לגורמים ספציפיים. כדי לקבוע את יעדי הניצול האופטימליים לעומס העבודה, אפשר להשתמש באסטרטגיות הבאות:
לפני שמשנים את היעדים, צריך לזהות את המדד שגורם לשירות להתרחב. כדי לזהות את מדד ההתאמה לגודל, פועלים לפי השלבים הבאים:
עוברים אל Metrics Explorer במסוף Google Cloud כדי לבדוק את תרשים המעקב של הגורם המניע את שינוי הגודל.
מחפשים את המדד
run.googleapis.com/scaling/recommended_instancesובוחרים אותו. מגדירים את Aggregation (צבירת נתונים) לערך Unaggregated (ללא צבירה) כדי לראות את המדד מקובץ לפי הגורם שמשפיע על ההתאמה לגודל.
הגורם המניע עם הערך הכי גבוה הוא זה ששולט במספר המופעים של השירות. אם רוצים לתת עדיפות לדרייבר אחר, או אם רוצים להגדיל או להקטין את המידה שבה משתמשים בדרייבר, צריך לשנות את יעד הניצול של הדרייבר הספציפי.
אם ACT הוא מנגנון ההתאמה של קנה המידה, המשמעות היא שהשימוש במעבד (CPU) למשך שנייה אחת חורג מ-90% עבור מופעים בודדים, ו-Cloud Run מגביל באופן דינמי את מספר הבקשות המקבילות כדי להגן על השירות. כדי לצמצם את ההשפעה של ACT על ההרחבה, מומלץ להגדיל את הקצאת ה-CPU או לשנות את הגדרות המקביליות. מידע נוסף זמין במאמר מידע על שינוי אוטומטי של גודל המכונה.
כדי לראות את ההשפעה על הביצועים, מומלץ לשנות את היעדים בהדרגה ולהמתין כמה דקות בין השינויים.
כדי לבדוק יעדי שינוי גודל חדשים, אפשר להשתמש בפיצול תעבורה כדי להפנות אחוז קטן מהתעבורה לגרסה נפרדת לפני שמשיקים אותם לכל השירות.
מידע על יעדים של ניצול נמוך
הורדת יעד הניצול למינימום של 0.1 (10%) משנה באופן משמעותי את האופן שבו השירות שלכם מתרחב.
היתרונות של הגדרת יעד ניצול נמוך כוללים:
זמינות גבוהה של השירות: השירות שלכם מתרחב הרבה יותר מוקדם, ושומר על מאגר גדול של קיבולת פנויה כדי להתמודד עם עליות פתאומיות בתנועת הגולשים בלי להשפיע על זמן האחזור.
שינוי גודל מהיר יותר במספרים נמוכים של מופעים: שינוי הגודל של השירותים אמין יותר לפני שמגיעים לצווארי בקבוק של ניצול גבוה.
חסרונות בהגדרת יעדים נמוכים של ניצול:
- פוטנציאל לעלייה בעלויות: אתם מריצים יותר מופעים ממה שנדרש לעומס הנוכחי, ולכן החיוב גבוה יותר.
- החלטות תכופות יותר לגבי שינוי גודל: ברמות ניצול נמוכות יותר, ל-Cloud Run יש סבילות נמוכה יותר, והוא לא מחכה זמן רב לפני שינוי הגודל.
המאמרים הבאים
- מידע נוסף על מושגים והתנהגויות שקשורים לשינוי גודל אוטומטי זמין במאמר מידע על שינוי גודל אוטומטי של מופעים בשירותי Cloud Run.
- אפשרויות נוספות לשינוי גודל מפורטות במאמר בנושא שינוי גודל ידני.
- כדי לנהל את המספר המקסימלי של מופעים של שירותי Cloud Run, אפשר לעיין במאמר בנושא הגדרת מספר מקסימלי של מופעים.
- כדי לנהל את המספר המקסימלי של בקשות בו-זמניות שמטופלות על ידי כל מופע, אפשר לעיין במאמר בנושא הגדרת מקביליות.
- כדי לבצע אופטימיזציה של הגדרת הבו-זמניות, אפשר לעיין בטיפים לפיתוח לצורך התאמה של בו-זמניות.
- כדי לציין מכונה בלי פעילות שתמשיך לפעול כדי לצמצם את זמן הטעינה או את ההפעלה במצב התחלתי (cold start) בבקשות הראשונות, אפשר לעיין במאמר בנושא שימוש ב-
min-instanceכדי להפעיל מכונות בלי פעילות.