Best practice per GKE

Questo documento fornisce una panoramica consolidata delle best practice per la progettazione, la creazione e il funzionamento delle applicazioni su Google Kubernetes Engine (GKE). Seguendo questi suggerimenti, puoi ottimizzare i costi, le prestazioni, la sicurezza e l'affidabilità. Ogni voce rimanda a una documentazione più dettagliata per argomenti specifici.

Seleziona una categoria di best practice:

Categoria Best practice Riepilogo
Workload AI e ML Ottimizza l'efficienza dei workload AI/ML Massimizza l'efficienza delle risorse per le attività di AI/ML su GKE.
Workload AI e ML Workload di inferenza Esegui carichi di lavoro di inferenza di machine learning su GKE.

Workload AI e ML

Affidabilità e scalabilità

Scalabilità automatica Inferenza LLM con GPU Scala automaticamente l'inferenza del modello linguistico di grandi dimensioni (LLM) utilizzando le GPU su GKE.

Workload AI e ML

Affidabilità e scalabilità

Scalabilità automatica Inferenza LLM con TPU Scala automaticamente l'inferenza del modello linguistico di grandi dimensioni (LLM) utilizzando le TPU su GKE.
Workload AI e ML Ottimizza l'inferenza LLM con le GPU Ottimizza l'inferenza LLM con le GPU su GKE.
Workload AI e ML Piattaforma di elaborazione batch Crea e gestisci una piattaforma di elaborazione batch su GKE.
Ottimizzazione dei costi Progettare e configurare i cluster per l'ottimizzazione dei costi Implementa configurazioni e strategie di alto valore per gestire cluster efficienti in termini di risorse.
Database Opzioni del database Scegli e gestisci le soluzioni di database per le applicazioni GKE.
Networking Networking Configura e gestisci la connettività di rete per GKE.
Networking Osservabilità della rete Implementa l'osservabilità, gli avvisi e l'ottimizzazione dei costi della rete per GKE.
Operazioni Upgrade dei cluster Scopri come eseguire upgrade dei cluster GKE fluidi e affidabili.
Operazioni CI/CD per GKE Implementa pipeline di integrazione e distribuzione continue per le applicazioni GKE.
Affidabilità e scalabilità Scalabilità Scopri i principi e le tecniche per scalare le applicazioni su GKE.
Affidabilità e scalabilità Pianifica la scalabilità Scopri le strategie per progettare ambienti GKE scalabili.
Affidabilità e scalabilità Pianifica cluster GKE di grandi dimensioni Scopri come progettare e gestire cluster GKE su larga scala.
Affidabilità e scalabilità Best practice per ComputeClasses Best practice per migliorare l'affidabilità, la scalabilità, la sicurezza e le prestazioni per ComputeClass.
Affidabilità e scalabilità Best practice per l'esecuzione dei carichi di lavoro HPC Best practice per ottimizzare l'esecuzione di workload di computing ad alte prestazioni (HPC) su GKE.
Affidabilità e scalabilità Pianifica carichi di lavoro di grandi dimensioni Esegui il deployment e gestisci applicazioni che richiedono molte risorse.
Sicurezza Proteggi il tuo cluster GKE Migliora la security posture di GKE dei tuoi cluster GKE.
Sicurezza Pianifica le policy RBAC Definisci controllo dell'accesso basato sui ruoli per gestire le autorizzazioni.
Sicurezza Multi-tenancy aziendale Esegui più tenant in modo sicuro su un singolo cluster GKE.
Sicurezza Best practice per la sicurezza dei carichi di lavoro AI su GKE Migliora la sicurezza dell'infrastruttura, dei modelli e delle applicazioni Kubernetes che formano i tuoi deployment di AI.