Per eseguire workload di intelligenza artificiale (AI), machine learning (ML) o computing ad alte prestazioni (HPC), puoi eseguire il deployment di istanze e cluster Compute Engine ottimizzati per l'AI che utilizzano macchine A4X, A4, A3 Ultra, A3 Mega e A3 High (8 GPU). Per saperne di più sulle funzionalità di queste macchine che ti consentono di eseguire cluster di AI e ML su larga scala, consulta Panoramica della gestione dei cluster.
Puoi creare istanze A4X, A4, A3 Ultra, A3 Mega e A3 High (8 GPU) direttamente da Compute Engine o tramite altri servizi in esecuzione su istanze Compute Engine come Cluster Toolkit o Google Kubernetes Engine.
Per l'opzione più appropriata per creare istanze o cluster di computing per il tuo caso d'uso, scegli una delle seguenti:
| Opzione | Caso d'uso |
|---|---|
| Cluster Director | Vuoi un servizio completamente gestito che automatizzi la configurazione dei cluster Slurm. Cluster Director ti aiuta a configurare le risorse di calcolo, networking e archiviazione per i tuoi cluster in modo da massimizzare le prestazioni e ridurre al minimo i tempi di inattività. Per saperne di più, consulta Creare un cluster Slurm completamente gestito per i workload di AI. |
| Cluster Toolkit | Vuoi utilizzare software open source che semplifichi la procedura di deployment dei cluster Slurm e GKE. Cluster Toolkit è progettato per essere altamente personalizzabile ed estensibile. Puoi utilizzare i blueprint per eseguire il provisioning delle risorse di networking e archiviazione. Per saperne di più, consulta: |
| GKE | Vuoi la massima flessibilità nella configurazione del cluster Google Kubernetes Engine in base alle esigenze del tuo workload. Per saperne di più, consulta: |
| Utilizzare Compute Engine | Vuoi il controllo completo del livello dell'infrastruttura in modo da poter configurare il tuo orchestratore. Per saperne di più, consulta:
|
Passaggi successivi
- Scopri di più sull'infrastruttura ottimizzata per le prestazioni di AI Hypercomputer: