Panoramica di Cloud Storage

Questa pagina descrive come funziona Cloud Storage e i casi d'uso che supporta.

Come funziona Cloud Storage

Cloud Storage è un servizio di archiviazione scalabile e gestito offerto da Google Cloud che ti consente di archiviare i dati come oggetti in contenitori chiamati bucket.

Tutti i bucket sono associati a un progetto e puoi raggruppare i tuoi progetti in un'organizzazione. Dopo aver creato un progetto, puoi creare bucket, caricare oggetti nei bucket e scaricare oggetti dai bucket. Puoi anche concedere autorizzazioni per rendere i tuoi dati accessibili alle entità che specifichi o accessibili a tutti su internet pubblico. Le funzionalità di directory ti consentono di utilizzare Cloud Storage in modo più simile a un disco rigido o a un Network Attached Storage (NAS): le cartelle ti consentono di organizzare gli oggetti in una struttura di directory e le cartelle gestite ti consentono di semplificare controllo dell'accesso ai tuoi oggetti.

Ogni progetto, bucket, oggetto, cartella e cartella gestita è una risorsa in Google Cloud, così come lo sono elementi come le istanze di Compute Engine.

La Google Cloud gerarchia

Ecco come la struttura di Cloud Storage può essere applicata a un caso reale:

  • Organizzazione: la tua azienda, chiamata Esempio S.p.A., crea un' Google Cloudorganizzazione chiamata exampleinc.org.

  • Progetto: Example Inc. sta creando diverse applicazioni e ognuna è associata a un progetto. Ogni progetto ha il proprio set di API Cloud Storage, nonché altre risorse.

  • Bucket: ogni progetto può contenere più bucket, che sono contenitori per archiviare gli oggetti. Ad esempio, puoi creare un bucket photos per tutti i file immagine generati dalla tua app e un bucket videos separato. Cloud Storage offre diverse classi di archiviazione e località per i bucket, consentendoti di scegliere la durabilità e la disponibilità dei dati in base alle esigenze dei tuoi carichi di lavoro.

    I bucket fungono da base di dati principale nell'ecosistema Google Cloud più ampio. Puoi connettere i tuoi bucket come backend di archiviazione per altri serviziGoogle Cloud , come AI Hypercomputer, Vertex AI e Google Kubernetes Engine.

  • Oggetto: i bucket contengono oggetti, ad esempio un'immagine chiamata puppy.png. Un oggetto è un dato immutabile costituito da un file di qualsiasi formato. Ogni bucket può contenere un numero illimitato di singoli oggetti.

  • Cartella: i bucket con lo spazio dei nomi gerarchico abilitato possono contenere cartelle. Le cartelle consentono di archiviare gli oggetti in un file system reale, anziché in uno simulato. Puoi rinominare in modo atomico una cartella e tutti gli oggetti al suo interno in un'unica operazione.

  • Cartella gestita: ogni bucket può contenere anche cartelle gestite, che concedono o revocano l'accesso aggiuntivo oltre alle autorizzazioni IAM impostate sul bucket. Le cartelle gestite non utilizzano una vera struttura ad albero di directory. Una cartella gestita è invece una sovrapposizione di risorse utilizzata solo per il controllo delle autorizzazioni.

Strumenti per Cloud Storage

Puoi interagire con Cloud Storage utilizzando i seguenti strumenti:

  • ConsoleGoogle Cloud : la console Google Cloud fornisce un'interfaccia visiva per gestire i dati in un browser.

  • Google Cloud CLI: gcloud CLI ti consente di interagire con Cloud Storage tramite un terminale utilizzando i comandi gcloud storage.

  • Librerie client: le librerie client Cloud Storage ti consentono di gestire i tuoi dati utilizzando uno dei tuoi linguaggi preferiti, tra cui C++, C#, Go, Java, Node.js, PHP, Python e Ruby.

  • API REST: gestisci i tuoi dati utilizzando l'API JSON o XML.

  • Terraform: Terraform è uno strumento Infrastructure as Code (IaC) che puoi utilizzare per eseguire il provisioning dell'infrastruttura per Cloud Storage. Per maggiori informazioni, consulta Eseguire il provisioning delle risorse con Cloud Storage.

  • gRPC: gRPC ti consente di interagire con Cloud Storage. gRPC è un framework RPC universale open source ad alte prestazioni sviluppato da Google che puoi utilizzare per definire i tuoi servizi utilizzando Protocol Buffers.

  • Cloud Storage FUSE: Cloud Storage FUSE ti consente di montare i bucket Cloud Storage nel file system locale. In questo modo, le applicazioni possono leggere da un bucket o scrivere in un bucket utilizzando la semantica standard del file system.

  • Libreria Python GCSFS: GCSFS è una libreria Python che fornisce un'interfaccia Pythonic del file system a Cloud Storage.

Casi d'uso e funzionalità chiave

Cloud Storage offre uno spazio di archiviazione di oggetti durevole e disponibile a livello globale che si adatta a un'ampia gamma di carichi di lavoro aziendali, dall'addestramento di intelligenza artificiale (AI) e machine learning (ML) ad alte prestazioni all'archiviazione normativa.

Archiviazione e accesso ai dati per AI/ML e analisi dei dati

Accelera le pipeline AI/ML e gli approfondimenti analitici con un accesso ai dati a bassa latenza e ad alta velocità effettiva progettato per l'elaborazione su larga scala.

Capacità Funzionalità, prodotto o caratteristica
Cloud Storage Rapid Archiviazione ad alte prestazioni collocata insieme al calcolo per un accesso inferiore al millisecondo e un throughput aggregato di più TB/s. Include:
  • Rapid Bucket: spazio di archiviazione di oggetti di zona nella classe di archiviazione Rapid Storage progettato per i workload di analisi e AI/ML con uso intensivo dei dati.
  • Rapid Cache: cache di lettura zonale completamente gestita e basata su SSD che scala automaticamente la capacità e la larghezza di banda per accelerare le prestazioni di lettura.
Spazio dei nomi gerarchico Organizza i dati in una struttura di directory logica con operazioni atomiche sulle cartelle e limiti QPS iniziali fino a 8 volte superiori rispetto ai bucket senza spazio dei nomi gerarchico. Lo spazio dei nomi gerarchico può essere abilitato solo al momento della creazione del bucket e non può essere abilitato su un bucket esistente.
Cloud Storage FUSE Monta i bucket sul file system locale, consentendo alle tue applicazioni di leggere da un bucket o scrivere in un bucket utilizzando la semantica standard del file system.

Per ulteriori dettagli sull'ottimizzazione delle prestazioni, vedi Ottimizzazione dello spazio di archiviazione per AI/ML e analisi dei dati.

Protezione dei dati e conformità

Proteggi le tue risorse e soddisfa gli standard normativi globali con crittografia, controlli degli accessi e norme di conservazione dei dati immutabili integrati.

Livello di sicurezza Funzionalità, prodotto o caratteristica
Controllo degli accessi Applica l'accesso con privilegi minimi e limita il traffico alle reti attendibili. I prodotti e le funzionalità includono:
  • Identity and Access Management: Autorizza utenti, gruppi o service account specifici a eseguire azioni sulle risorse Cloud Storage tramite controlli dell'accesso basati sui ruoli.
  • Accesso uniforme a livello di bucket: unifica il controllo dell'accesso dell'accesso per le tue risorse Cloud Storage disattivando gli elenchi di controllo dell'accesso (ACL) a livello di oggetto e utilizzando esclusivamente le policy IAM a livello di bucket.
  • Filtro IP bucket: Limita l'accesso a un bucket in base all'indirizzo IP di origine della richiesta e proteggi i tuoi dati da accessi non autorizzati da indirizzi IP o Virtual Private Cloud (VPC) specifici.
Crittografia dei dati Crittografare i dati at-rest e in transito. I prodotti e le funzionalità includono:
  • Chiavi gestite daGoogle: Cripta automaticamente i dati Cloud Storage a riposo per impostazione predefinita utilizzando chiavi lato server di proprietà di Googlee gestite da quest'ultimo.
  • CMEK (Cloud KMS): Controlla le pianificazioni della rotazione, le autorizzazioni di accesso e i cicli di vita delle chiavi di crittografia per proteggere le risorse Cloud Storage.
  • CSEK: Proteggi i tuoi dati Cloud Storage at-rest fornendo le tue chiavi crittografiche con ogni singola richiesta API, anziché Google memorizzare o recuperare il materiale della chiave.
Conservazione e immutabilità dei dati Evita l'eliminazione accidentale e contribuisci a soddisfare la conformità dei dati. I prodotti e le funzionalità includono:
  • Blocco di bucket: Controlla per quanto tempo gli oggetti nei bucket devono essere conservati specificando un criterio di conservazione per il bucket per applicare le regole di conservazione dei dati normative e di conformità.
  • Conservazione degli oggetti: Gestisci il ciclo di vita dei singoli oggetti applicando una data e un'ora di conservazione immutabili a oggetti specifici, impedendo che vengano eliminati o sostituiti fino alla scadenza di questo periodo.
  • Controllo delle versioni degli oggetti: Conserva le copie storiche dei tuoi dati archiviando automaticamente gli oggetti live sovrascritti o eliminati come versioni non correnti, consentendoti di ripristinare gli stati precedenti degli oggetti in qualsiasi momento.
  • Eliminazione temporanea: Evita la perdita permanente di dati in caso di eliminazione accidentale o dannosa conservando gli oggetti e i bucket eliminati di recente. Per impostazione predefinita, Cloud Storage abilita l'eliminazione temporanea per tutti i bucket con un periodo di conservazione di sette giorni.

Backup, ripristino di emergenza e continuità aziendale

Proteggi la tua attività da perdite di dati, eventi di emergenza e interruzioni a livello di regione con disponibilità multiregionale e replica rapida tra regioni.

Funzionalità, prodotto o caratteristica Descrizione
Doppie regioni e multiregioni Replica automaticamente i dati in regioni Google Cloud separate geograficamente per una disponibilità del 99,99%.
Replica turbo Replica il 100% degli oggetti appena scritti tra coppie a due regioni entro 15 minuti.
Controllo delle versioni degli oggetti ed eliminazione temporanea Conserva le iterazioni precedenti e gli oggetti eliminati di recente per il rollback dopo sovrascritture accidentali o eventi ransomware.

Ottimizzazione dei costi e gestione del ciclo di vita dei dati

Ridurre la spesa per l'archiviazione durante il ciclo di vita dei dati abbinando la frequenza di accesso a livelli di archiviazione convenienti.

Classe di archiviazione, prodotto o funzionalità Descrizione
Classi di archiviazione Scegli tra Standard Storage, Nearline Storage, Coldline Storage, Archive Storage e Rapid Storage in base alla frequenza di accesso ai dati.
Autoclass Trasferisci automaticamente gli oggetti tra le classi di archiviazione in base ai pattern di accesso agli oggetti.
Gestione del ciclo di vita degli oggetti Elimina o esegui la transizione degli oggetti utilizzando policy personalizzate basate su regole.

Distribuzione di contenuti e pubblicazione web

Distribuisci asset digitali, download e file multimediali a livello globale con bassa latenza e alta affidabilità.

Funzionalità, prodotto o caratteristica Descrizione
Cloud CDN e Cloud Load Balancing Memorizza nella cache gli asset statici nelle località perimetrali globali di Googleper la distribuzione web a latenza molto bassa.
URL firmati Fornisci l'accesso in lettura o scrittura a tempo limitato a oggetti privati senza richiedere Google credenziali.
Hosting di siti web statici Pubblica asset statici HTML, CSS, JavaScript e multimediali direttamente da un bucket pubblico.

Migrazione dei dati e importazione basata sugli eventi

Semplifica lo spostamento dei dati esterni in Google Cloud e attiva i flussi di lavoro di elaborazione automatica al caricamento degli oggetti.

Integrazione Descrizione
Storage Transfer Service Trasferimento gestito e su larga scala di dati online da Amazon S3, Microsoft Azure Blob Storage, origini HTTP o spazio di archiviazione on-premise.
Transfer Appliance Apparecchiature hardware rinforzate che spediscono fino a centinaia di petabyte di dati offline a Google Cloud.
Eventarc e Pub/Sub Emetti notifiche di eventi in tempo reale in caso di creazione, eliminazione o aggiornamento dei metadati degli oggetti per attivare i servizi Cloud Functions o Cloud Run.

Nomi delle risorse

Ogni risorsa ha un nome univoco che la identifica, proprio come un nome file. I bucket hanno un nome risorsa nel formato projects/_/buckets/BUCKET_NAME, dove BUCKET_NAME è l'ID del bucket. Gli oggetti hanno un nome risorsa nel formato projects/_/buckets/BUCKET_NAME/objects/OBJECT_NAME, dove OBJECT_NAME è l'ID dell'oggetto.

Un #NUMBER aggiunto alla fine del nome della risorsa indica una generazione specifica dell'oggetto. #0 è un identificatore speciale per la versione più recente di un oggetto. #0 è utile da aggiungere quando il nome dell'oggetto termina con una stringa che altrimenti verrebbe interpretata come un numero di generazione.

Guide rapide

Per scoprire le nozioni di base sull'utilizzo di Cloud Storage, consulta le seguenti guide:

Cerchi altri prodotti?

Se Cloud Storage non è la soluzione di archiviazione giusta per te, consulta ulteriori informazioni sui seguenti servizi di archiviazione:

  • Google Cloud Managed Lustre: archivia i tuoi dati in un file system parallelo ad alte prestazioni e completamente gestito, ottimizzato per i carichi di lavoro AI e HPC.

  • Google Drive: archivia, gestisci e condividi i tuoi file personali.

  • Cloud Storage for Firebase: gestisci i dati per le tue applicazioni mobile.

  • Persistent Disk: aggiungi l'archiviazione a blocchi alla tua macchina virtuale Compute Engine.

  • Filestore: aggiungi spazio di archiviazione file per l'accesso multi-scrittore ai tuoi cluster GKE.

  • Esplora altri servizi di archiviazione offerti da Google.

Passaggi successivi