Escalar cargas de trabajo sin estado

En este documento se describe cómo escalar las cargas de trabajo sin estado que se ejecutan en un clúster de Kubernetes aislado de Google Distributed Cloud (GDC). Debes escalar los pods que se ejecutan en tus cargas de trabajo sin estado a medida que evolucionen los requisitos de tu carga de trabajo de contenedor.

Este documento está dirigido a los desarrolladores del grupo de operadores de aplicaciones que se encargan de gestionar las cargas de trabajo de las aplicaciones de su organización. Para obtener más información, consulta Audiencias de la documentación aislada de GDC.

Antes de empezar

Para completar las tareas de este documento, debes solicitar los permisos necesarios y preparar tu entorno.

Solicitar roles de gestión de identidades y accesos

Debes tener roles específicos para obtener los permisos que necesitas para escalar cargas de trabajo sin estado. Los roles que necesitas dependen de si trabajas en un clúster compartido con ámbito de organización o en un clúster estándar con ámbito de proyecto. Para obtener más información, consulta Configuraciones de clústeres de Kubernetes.

Roles de clúster compartidos

Para crear, eliminar, editar o ver cargas de trabajo en un clúster compartido, pide a tu administrador de IAM del proyecto que te asigne el rol Administrador de espacio de nombres (namespace-admin). Este rol está vinculado al espacio de nombres de tu proyecto.

Roles de clúster estándar

Para crear, eliminar, editar o ver cargas de trabajo en un clúster estándar, pide al administrador de gestión de identidades y accesos del proyecto que te conceda el rol Desarrollador de clúster (cluster-developer). Este rol está vinculado al espacio de nombres de tu proyecto.

Prepara tu entorno

Para ejecutar comandos en un clúster de Kubernetes mediante la API, asegúrate de tener los siguientes recursos:

  • Busca el nombre del clúster de Kubernetes o pregunta a un miembro del grupo de administradores de la plataforma cuál es el nombre del clúster.

  • Inicia sesión y genera el archivo kubeconfig del clúster de Kubernetes.

  • Usa la ruta kubeconfig del clúster de Kubernetes para sustituir KUBERNETES_CLUSTER_KUBECONFIG en estas instrucciones.

Escalar un despliegue

Usa la función de escalado de Kubernetes para escalar adecuadamente la cantidad de pods que se ejecutan en tu implementación.

Autoescalar los pods de un despliegue

Kubernetes ofrece el escalado automático para que no tengas que actualizar manualmente tu implementación cuando cambie la demanda. Sigue estos pasos para escalar automáticamente los pods de tu implementación:

  1. Para asegurarte de que el autoescalador horizontal de pods pueda medir correctamente el porcentaje de CPU, define la solicitud de recursos de CPU en tu despliegue.

  2. Define el autoescalador de pods horizontal en tu despliegue:

    kubectl --kubeconfig KUBERNETES_CLUSTER_KUBECONFIG \
        -n NAMESPACE \
        autoscale deployment DEPLOYMENT_NAME \
        --cpu-percent=CPU_PERCENT \
        --min=MIN_NUMBER_REPLICAS \
        --max=MAX_NUMBER_REPLICAS
    

    Haz los cambios siguientes:

    • KUBERNETES_CLUSTER_KUBECONFIG: el archivo kubeconfig del clúster.

    • NAMESPACE: el espacio de nombres. En el caso de los clústeres compartidos, debe ser un espacio de nombres de proyecto. En los clústeres estándar, puede ser cualquier espacio de nombres.

    • DEPLOYMENT_NAME: el nombre del despliegue que se va a escalar automáticamente.

    • CPU_PERCENT: el uso medio de CPU objetivo que se va a solicitar, representado como un porcentaje, en todos los pods.

    • MIN_NUMBER_REPLICAS: límite inferior del número de pods que puede aprovisionar el escalador automático.

    • MAX_NUMBER_REPLICAS: límite superior del número de pods que puede aprovisionar el escalador automático.

  3. Comprueba el estado actual del autoescalador horizontal de pods:

    kubectl get hpa
    

    El resultado debería ser similar al siguiente:

    NAME              REFERENCE                          TARGET    MINPODS   MAXPODS   REPLICAS   AGE
    DEPLOYMENT_NAME   Deployment/DEPLOYMENT_NAME/scale   0% / 50%  1         10        1          18s
    

Escalar manualmente los pods de un despliegue

Si prefieres escalar manualmente una implementación, ejecuta el siguiente comando:

kubectl --kubeconfig KUBERNETES_CLUSTER_KUBECONFIG \
    -n NAMESPACE \
    scale deployment DEPLOYMENT_NAME \
    --replicas NUMBER_OF_REPLICAS

Haz los cambios siguientes:

  • KUBERNETES_CLUSTER_KUBECONFIG: el archivo kubeconfig del clúster.

  • NAMESPACE: el espacio de nombres. En el caso de los clústeres compartidos, debe ser un espacio de nombres de proyecto. En los clústeres estándar, puede ser cualquier espacio de nombres.

  • DEPLOYMENT_NAME: el nombre del despliegue en el que se va a autoescalar.

  • DEPLOYMENT_NAME: el número de objetos Pod replicados en la implementación.

Siguientes pasos