En este documento, se proporciona una descripción general consolidada de las prácticas recomendadas para diseñar, compilar y operar aplicaciones en Google Kubernetes Engine (GKE). Seguir estas recomendaciones te ayuda a optimizar los costos, el rendimiento, la seguridad y la confiabilidad. Cada entrada se vincula a documentación más detallada sobre temas específicos.
Selecciona una categoría de prácticas recomendadas:
| Categoría | Prácticas recomendadas | Resumen |
|---|---|---|
| Cargas de trabajo de IA y AA | Optimiza la eficiencia de las cargas de trabajo de IA/AA | Maximizar la eficiencia de los recursos para las tareas de IA/AA en GKE |
| Cargas de trabajo de IA y AA | Cargas de trabajo de inferencia | Ejecuta cargas de trabajo de inferencia de aprendizaje automático en GKE. |
|
Cargas de trabajo de IA y AA Confiabilidad y escalabilidad |
Ajusta automáticamente la escala de la inferencia de LLM con GPUs | Ajusta automáticamente la escala de la inferencia de modelos de lenguaje grandes (LLM) con GPUs en GKE. |
|
Cargas de trabajo de IA y AA Confiabilidad y escalabilidad |
Ajuste de escala automático de la inferencia de LLM con TPU | Ajusta automáticamente la escala de la inferencia del modelo de lenguaje grande (LLM) con TPU en GKE. |
| Cargas de trabajo de IA y AA | Optimiza la inferencia de LLM con GPUs | Optimiza la inferencia de LLM con GPUs en GKE. |
| Cargas de trabajo de IA y AA | Plataforma de procesamiento por lotes | Compila y opera una plataforma de procesamiento por lotes en GKE. |
| Optimización de costos | Diseña y configura clústeres para optimizar los costos | Implementa estrategias y parámetros de configuración de alto valor para operar clústeres eficientes en el uso de recursos. |
| Bases de datos | Opciones de bases de datos | Elegir y administrar soluciones de bases de datos para aplicaciones de GKE |
| Redes | Redes | Configurar y administrar la conectividad de red para GKE |
| Redes | Observabilidad de la red | Implementa la observabilidad, las alertas y la optimización de costos de la red para GKE. |
| Operaciones | Actualización de clústeres | Obtén información para realizar actualizaciones de clúster de GKE sin problemas y confiables. |
| Operaciones | CI/CD para GKE | Implementa canalizaciones de integración y entrega continuas para aplicaciones de GKE. |
| Confiabilidad y escalabilidad | Escalabilidad | Aprende los principios y las técnicas para escalar aplicaciones en GKE. |
| Confiabilidad y escalabilidad | Planifica la escalabilidad | Conoce las estrategias para diseñar entornos de GKE escalables. |
| Confiabilidad y escalabilidad | Planifica clústeres de GKE grandes | Aprende a diseñar y administrar clústeres de GKE a gran escala. |
| Confiabilidad y escalabilidad | Prácticas recomendadas para ComputeClasses | Prácticas recomendadas para mejorar la confiabilidad, la escalabilidad, la seguridad y el rendimiento de las ComputeClasses. |
| Confiabilidad y escalabilidad | Prácticas recomendadas para ejecutar cargas de trabajo de HPC | Prácticas recomendadas para optimizar la ejecución de cargas de trabajo de computación de alto rendimiento (HPC) en GKE. |
| Confiabilidad y escalabilidad | Planifica cargas de trabajo grandes | Implementar y administrar aplicaciones que consumen muchos recursos |
| Seguridad | Endurece tu clúster de GKE | Mejora la postura de seguridad de GKE de tus clústeres de GKE. |
| Seguridad | Planifica las políticas de RBAC | Define el control de acceso basado en roles para administrar los permisos. |
| Seguridad | Multiusuario empresarial | Ejecuta varios arrendatarios de forma segura en un solo clúster de GKE. |
| Seguridad | Prácticas recomendadas para la seguridad de las cargas de trabajo de IA en GKE | Mejora la seguridad de la infraestructura, los modelos y las aplicaciones de Kubernetes que forman tus implementaciones de IA. |