Questo documento descrive come monitorare e provare a ottimizzare le risorse per un job Batch visualizzando le metriche in Cloud Monitoring. Per scoprire di più sulle risorse su cui viene eseguito un job, consulta Risorse dei job.
Per qualsiasi job, Monitoring fornisce metriche di base come l'utilizzo della CPU e il traffico di rete. Tuttavia, alcune metriche, come l'utilizzo della memoria e dei processi, possono essere raccolte solo se un job installa Ops Agent. Le metriche per le risorse di un job ti aiutano a valutare le prestazioni e l'utilizzo di ogni risorsa. Queste informazioni possono aiutarti a identificare i miglioramenti per le iterazioni future del job. Ad esempio, potresti rimuovere le risorse non utilizzate per ottimizzare i costi oppure migliorare o aumentare le risorse sotto pressione per migliorare le prestazioni.
Prima di iniziare
- Se non hai mai utilizzato Batch, consulta la guida introduttiva a Batch e abilita Batch completando i prerequisiti per progetti e utenti.
- (Facoltativo) Per raccogliere metriche aggiuntive per un job, crea ed esegui un job che installa automaticamente Ops Agent.
- Se non l'hai ancora fatto, abilita l'API Monitoring:
Ruoli richiesti per abilitare le API
Per abilitare le API, devi disporre dell'autorizzazione
serviceusage.services.enable. Se hai creato il progetto, probabilmente hai già questa autorizzazione tramite il ruolo Proprietario (roles/owner). In caso contrario, puoi ottenere questa autorizzazione tramite il ruolo Amministratore utilizzo servizi (roles/serviceusage.serviceUsageAdmin). Scopri come concedere i ruoli. -
Per ottenere le autorizzazioni necessarie per visualizzare le metriche di osservabilità, chiedi all'amministratore di concederti il ruolo IAM Visualizzatore metriche di Monitoring (
roles/monitoring.metricViewer) sul progetto. Per saperne di più sulla concessione dei ruoli, consulta Gestisci l'accesso a progetti, cartelle e organizzazioni.Potresti anche riuscire a ottenere le autorizzazioni richieste tramite i ruoli personalizzati o altri ruoli predefiniti.
Visualizzare le metriche per le risorse dei job
La sezione Osserva e monitora le VM in nella documentazione di Compute Engine fornisce informazioni concettuali pertinenti sulle metriche delle VM; tuttavia, sono consigliati metodi diversi per visualizzare le metriche delle VM per i job Batch. In particolare, la documentazione di Compute Engine spiega come visualizzare le metriche utilizzando le dashboard di Monitoring predefinite per Compute Engine o le pagine di Compute Engine nella Google Cloud console. Tuttavia, è importante sottolineare che questi metodi non mostrano informazioni sulle VM eliminate. Di conseguenza, non utilizzare questi metodi a meno che tu non voglia visualizzare le metriche per i job Batch solo durante l'esecuzione.
Visualizza le metriche per i job batch in esecuzione e completati utilizzando i grafici di Metrics Explorer, come spiegato in questa sezione. Tieni presente che i grafici sono temporanei, a meno che tu non li salvi nelle dashboard personalizzate.
Per creare un grafico per visualizzare una o più metriche:
- (Facoltativo) Se prevedi di salvare il grafico, identifica o crea una dashboard personalizzata per il grafico.
Crea un grafico di Metrics Explorer per una o più metriche.
Senza filtri, ogni metrica della VM in un grafico include i dati di tutte le VM nel tuo progetto. (Facoltativo) Se vuoi filtrare il grafico in modo da includere solo le metriche di tutti o di job Batch specifici, aggiungi il seguente filtro:
group=RESOURCE_GROUP_NAMESostituisci
RESOURCE_GROUP_NAMEcon il nome di un gruppo di risorse per i job Batch. Per saperne di più, consulta Creare gruppi di risorse per filtrare le metriche in questo documento.
Creare gruppi di risorse per filtrare le metriche
Puoi utilizzare i gruppi di risorse come filtri personalizzabili per i grafici di Metrics Explorer. Per creare un gruppo di risorse per tutti o per job Batch specifici nel tuo progetto:
Seleziona un'etichetta da utilizzare come criteri di appartenenza in base ai job che vuoi includere nel gruppo:
- Tutti i job Batch: utilizza l'etichetta predefinita
batch-node, che viene applicata automaticamente a tutte le risorse di tutti i job Batch e ha un valore nullo. Job Batch specifici: utilizza un'etichetta applicata alle risorse solo per job Batch specifici.
Ad esempio, se vuoi creare un gruppo in base ai nomi dei job completi o parziali, utilizza il nome dell'etichetta predefinita
batch-job-idcon un valore specifico. L'etichettabatch-job-idviene applicata automaticamente a tutte le risorse di tutti i job Batch e definita con il nome del job.In alternativa, se utilizzi un'etichetta personalizzata, devi applicarla a tutte le risorse dei job Batch che vuoi includere nel gruppo quando crei i job.
- Tutti i job Batch: utilizza l'etichetta predefinita
Assicurati che il tuo progetto abbia almeno un job con l'etichetta selezionata e che questo job sia nello stato
RUNNING. In caso contrario, questa etichetta non verrà visualizzata come opzione quando provi a creare il gruppo di risorse.Crea un gruppo di risorse. Quando specifichi i criteri di appartenenza:
- Imposta Tipo su Tag.
Imposta il campo Tag sul nome dell'etichetta selezionata. Quindi, imposta i seguenti campi in base ai valori delle etichette che vuoi includere nel gruppo.
Ad esempio, se vuoi che questo gruppo includa tutti i job Batch, imposta Tag su
batch-nodee Operatore su Esiste. In alternativa, se vuoi che questo gruppo includa i job Batch con nomi che iniziano contest, imposta Tag subatch-job-id, imposta Operatore su Inizia con e imposta Valore sutest.
Passaggi successivi
- Scopri di più sulle metriche delle risorse dei job:
- Scopri altri metodi per monitorare e ottimizzare i job Batch: