Panoramica delle opzioni di deployment

Per eseguire workload di intelligenza artificiale (AI), machine learning (ML) o computing ad alte prestazioni (HPC), puoi eseguire il deployment di istanze e cluster Compute Engine ottimizzati per l'AI che utilizzano macchine A4X, A4, A3 Ultra, A3 Mega e A3 High (8 GPU). Per saperne di più sulle funzionalità di queste macchine che ti consentono di eseguire cluster di AI e ML su larga scala, consulta Panoramica della gestione dei cluster.

Puoi creare istanze A4X, A4, A3 Ultra, A3 Mega e A3 High (8 GPU) direttamente da Compute Engine o tramite altri servizi in esecuzione su istanze Compute Engine come Cluster Toolkit o Google Kubernetes Engine.

Per l'opzione più appropriata per creare istanze o cluster di computing per il tuo caso d'uso, scegli una delle seguenti:

Opzione Caso d'uso
Cluster Director Vuoi un servizio completamente gestito che automatizzi la configurazione dei cluster Slurm. Cluster Director ti aiuta a configurare le risorse di calcolo, networking e archiviazione per i tuoi cluster in modo da massimizzare le prestazioni e ridurre al minimo i tempi di inattività. Per saperne di più, consulta Creare un cluster Slurm completamente gestito per i workload di AI.
Cluster Toolkit

Vuoi utilizzare software open source che semplifichi la procedura di deployment dei cluster Slurm e GKE. Cluster Toolkit è progettato per essere altamente personalizzabile ed estensibile. Puoi utilizzare i blueprint per eseguire il provisioning delle risorse di networking e archiviazione. Per saperne di più, consulta:

GKE

Vuoi la massima flessibilità nella configurazione del cluster Google Kubernetes Engine in base alle esigenze del tuo workload. Per saperne di più, consulta:

Utilizzare Compute Engine

Vuoi il controllo completo del livello dell'infrastruttura in modo da poter configurare il tuo orchestratore. Per saperne di più, consulta:

Passaggi successivi