Cómo escalar cargas de trabajo sin estado

Ajusta la escala de tus cargas de trabajo sin estado según los requisitos cambiantes de las cargas de trabajo de contenedores.

Antes de comenzar

Para completar las tareas de este documento, debes solicitar los permisos necesarios y preparar tu entorno.

Solicita roles de IAM

Para crear, borrar, editar o ver cargas de trabajo sin estado en un clúster de Kubernetes, pídele a tu administrador de IAM de la organización que te otorgue el rol de Administrador de espacio de nombres (namespace-admin). Este rol está vinculado al espacio de nombres de tu proyecto.

Prepara el entorno

Para ejecutar comandos en el clúster de Kubernetes de Bare Metal preconfigurado, asegúrate de tener los siguientes recursos:

  1. Ubica el nombre del clúster de Kubernetes o pregúntale a tu administrador de la plataforma cuál es el nombre del clúster.

  2. Accede y genera el archivo kubeconfig para el clúster de Kubernetes si no tienes uno.

  3. Usa la ruta de acceso kubeconfig del clúster de Kubernetes para reemplazar CLUSTER_KUBECONFIG en estas instrucciones.

Escala un Deployment

Aprovecha la funcionalidad de ajuste de escala de Kubernetes para ajustar de forma adecuada la escala de la cantidad de pods que se ejecutan en tu implementación.

Ajusta automáticamente la escala de los pods de un Deployment

Kubernetes ofrece el ajuste de escala automático para eliminar la necesidad de actualizar manualmente tu implementación cuando evoluciona la demanda. Configura el escalador automático horizontal de Pods en tu implementación para habilitar esta función:

kubectl --kubeconfig CLUSTER_KUBECONFIG \
    -n NAMESPACE \
    autoscale deployment DEPLOYMENT_NAME \
    --cpu-percent=CPU_PERCENT \
    --min=MIN_NUMBER_REPLICAS \
    --max=MAX_NUMBER_REPLICAS

Reemplaza lo siguiente:

  • CLUSTER_KUBECONFIG: El archivo kubeconfig del clúster de Kubernetes.

  • NAMESPACE: El espacio de nombres del proyecto.

  • DEPLOYMENT_NAME: El nombre del Deployment en el que se ajustará automáticamente la escala.

  • CPU_PERCENT: El uso promedio objetivo de CPU que se solicitará, representado como un porcentaje, en todos los pods.

  • MIN_NUMBER_REPLICAS: El límite inferior para la cantidad de pods que puede aprovisionar el escalador automático.

  • MAX_NUMBER_REPLICAS: El límite superior para la cantidad de pods que puede aprovisionar el escalador automático.

Para verificar el estado actual del escalador automático horizontal de Pods recién creado, ejecuta lo siguiente:

kubectl get hpa

El resultado es similar a este:

NAME              REFERENCE                          TARGET    MINPODS   MAXPODS   REPLICAS   AGE
DEPLOYMENT_NAME   Deployment/DEPLOYMENT_NAME/scale   0% / 50%  1         10        1          18s

Ajusta manualmente la escala de los pods de un Deployment

Si prefieres ajustar manualmente la escala de un Deployment, ejecuta lo siguiente:

kubectl --kubeconfig CLUSTER_KUBECONFIG \
    -n NAMESPACE \
    scale deployment DEPLOYMENT_NAME \
    --replicas NUMBER_OF_REPLICAS

Reemplaza lo siguiente:

  • CLUSTER_KUBECONFIG: El archivo kubeconfig del clúster de Kubernetes.

  • NAMESPACE: El espacio de nombres del proyecto.

  • DEPLOYMENT_NAME: El nombre del Deployment en el que se ajustará automáticamente la escala.

  • DEPLOYMENT_NAME: La cantidad elegida de objetos Pod replicados en el Deployment.