Panoramica della capacità

AI Hypercomputer supporta diverse opzioni di consumo per aiutarti a ottenere e utilizzare le risorse di calcolo. Questo documento fornisce una panoramica di come ottenere la capacità per ogni opzione di consumo.

Come ottenere la capacità

La tabella seguente descrive come ottenere capacità per ogni opzione di consumo.

Opzione di consumo Procedura per ottenere la capacità Implicazioni sui prezzi
Prenotazioni future in AI Hypercomputer

Per ottenere le risorse di prenotazione future, la procedura è la seguente:

  1. Prenota la capacità contattando il team dedicato all'account.
  2. La quota viene aumentata automaticamente prima che venga fornita la capacità. Non è necessario alcun intervento da parte tua.
  3. Quando crei un'istanza o un cluster Compute Engine, specifica il modello di provisioning vincolato alla prenotazione. Il provisioning delle istanze di computing e dei cluster viene eseguito dalla capacità riservata.
Ti viene addebitato l'intero periodo di prenotazione, indipendentemente dal fatto che tu utilizzi le risorse prenotate per l'intero periodo. Per saperne di più, consulta la sezione Fatturazione delle prenotazioni della documentazione sulle prenotazioni di Compute Engine.
Prenotazioni future per meno di 90 giorni (in modalità calendario)

Per ottenere le risorse di prenotazione future, la procedura è la seguente:

  1. Cerca la capacità disponibile e prenota le risorse.
  2. Non viene addebitata alcuna quota e non è richiesta alcuna azione da parte tua.
  3. Quando crei un'istanza di computing o un cluster, devi specificare il modello di provisioning vincolato alla prenotazione. Il provisioning delle istanze di computing e dei cluster viene eseguito dalla capacità riservata.
Ti viene addebitato l'intero periodo di prenotazione, indipendentemente dal fatto che tu utilizzi le risorse prenotate per l'intero periodo. Per ulteriori informazioni, consulta i prezzi di Dynamic Workload Scheduler.
Avvio flessibile

Per questa opzione di consumo, non è richiesta alcuna prenotazione. Per ottenere le risorse ad avvio flessibile, la procedura è la seguente:

  1. Devi richiedere una quota prerilasciabile per il tipo di macchina GPU che vuoi utilizzare.
  2. Quando crei istanze di computing o cluster utilizzando una delle seguenti opzioni, specifica il modello di provisioning con avvio flessibile:

    Quando le risorse richieste diventano disponibili, Compute Engine esegue il provisioning delle VM. Le VM vengono eseguite per un massimo di sette giorni.

Ti vengono addebitati i costi quando le risorse sono in uso. Le risorse di cui è stato eseguito il provisioning utilizzando l'inizio flessibile ricevono automaticamente sconti tramite i prezzi di Dynamic Workload Scheduler.
On demand

Per questa opzione di consumo, la prenotazione della capacità è facoltativa. Le risorse on demand sono disponibili solo per le GPU generiche (come N1, G2, G4, A2 o A3 Edge). Per ottenere queste risorse on demand, la procedura è la seguente:

  1. Richiedi una quota di GPU standard per il tipo di macchina che vuoi utilizzare. Per ulteriori informazioni, consulta Richiedere un aumento della quota.
  2. Verifica la disponibilità controllando le regioni preferite per il tuo hardware nell'elenco Disponibilità delle GPU per regione e zona di Compute Engine.
  3. Crea un'istanza di computing o un cluster e specifica il modello di provisioning standard. Il provisioning delle risorse viene eseguito immediatamente in base alla capacità disponibile.
Vengono applicate le tariffe on demand standard durante l'utilizzo delle risorse.
Prenotazioni on demand

Le prenotazioni on demand (a volte chiamate prenotazioni) sono disponibili solo per le GPU generiche (ad esempio G2, G4, A2 o A3 Edge). Per prenotare la capacità, la procedura è la seguente:

  1. Richiedi la quota di GPU standard per il tuo tipo di macchina. Per i dettagli, consulta Richiedere un aumento della quota.
  2. Crea una prenotazione on demand per il tipo specifico di VM e GPU utilizzando la console Google Cloud , gcloud CLI o altri metodi. Per informazioni dettagliate su tutti i metodi per creare prenotazioni, vedi Crea una prenotazione per un singolo progetto.
  3. Esegui il provisioning delle risorse creando un'istanza o un cluster e scegliendo come target la prenotazione specifica.
Le tariffe standard vengono applicate per l'intero periodo di prenotazione. Applica gli sconti per impegno di utilizzo (CUD) per ottenere risparmi significativi.
Prenotazioni future standard

Per questa opzione di consumo, prenoti la capacità per una data futura. Le prenotazioni future standard utilizzano il modello di provisioning standard e sono disponibili solo per le GPU generiche.

  1. Richiedi la quota di GPU standard per il tuo tipo di macchina. Per i dettagli, consulta Richiedere un aumento della quota.
  2. Crea una richiesta di prenotazione futura per il tipo di VM e GPU specifico.
  3. Quando la prenotazione raggiunge l'ora di inizio, crea istanze di computing utilizzando la capacità riservata.
Le tariffe standard vengono applicate per l'intero periodo di prenotazione. Applica gli sconti per impegno di utilizzo (CUD) per ottenere risparmi significativi.
Spot

Per questa opzione di consumo, non è richiesta alcuna prenotazione. Per ottenere risorse spot, la procedura è la seguente:

  1. Devi richiedere una quota prerilasciabile per il tipo di macchina GPU che vuoi utilizzare.
  2. Visualizza la disponibilità delle risorse nella regione o nella zona in cui vuoi creare istanze di calcolo.
  3. Quando crei un'istanza o un cluster di computing, specifica il modello di provisioning spot. Le risorse vengono sottoposte a provisioning per te man mano che la capacità diventa disponibile, ma possono essere interrotte in qualsiasi momento.
Ti vengono addebitati i costi quando le risorse sono in uso. Le VM spot ricevono automaticamente sconti tramite Prezzi di VM spot.

Passaggi successivi