Visão geral da computação do Google

Este documento apresenta os serviços de computação disponíveis no Google Cloud. Ao entender o espectro de controle de infraestrutura e abstração de gerenciamento, você pode adquirir o conhecimento básico necessário para escolher o serviço de computação certo para suas cargas de trabalho.

O termo computação se Google Cloud referem aos recursos de computação virtualizados, como poder de processamento e memória, necessários para executar seus aplicativos. Esses recursos variam de instâncias de máquina virtual (VM) brutas a plataformas totalmente gerenciadas. Com as instâncias de VM, você pode personalizar totalmente o sistema operacional (SO), a rede e a pilha de software. Para plataformas gerenciadas, o Google lida com a maior parte da infraestrutura subjacente.

Áreas de serviço de alto nível

A categoria de computação no Google Cloud abrange as seguintes áreas de serviço de chaves:

  • Instâncias de VM e instâncias bare metal: o Compute Engine oferece instâncias de VM e bare metal configuráveis em que você pode instalar e gerenciar seu próprio SO e aplicativos. Essa configuração também inclui a adição de unidades de processamento gráfico (GPUs) ou unidades de processamento de tensor (TPUs) a uma VM personalizada ou instância bare metal.

  • Contêineres: serviços como o Google Kubernetes Engine (GKE) permitem implantar e gerenciar aplicativos conteinerizados.

  • Processamento em lote: serviços como o Batch ajudam a executar jobs assíncronos em grande escala.

  • Infraestrutura de IA: inclui serviços e ferramentas especializados, como o Cluster Director e o Cluster Cluster Toolkit, hardware criado para fins específicos (GPUs NVIDIA e TPUs do Google), software aberto e modelos de consumo flexíveis. Esses serviços são projetados para executar cargas de trabalho complexas e orquestradas de treinamento e inferência para inteligência artificial (IA) ou machine learning (ML) em escala.

  • Infraestrutura de HPC: inclui serviços e hardware especializados para executar cargas de trabalho de computação de alto desempenho (HPC), como simulações de física fortemente acopladas, modelos climáticos ou dinâmica molecular.

Controle versus abstração na infraestrutura

Google Cloud oferece serviços de computação em um espectro de controle e abstração. As duas categorias principais são as seguintes:

Infraestrutura como serviço

A infraestrutura como serviço (IaaS) é o modelo que oferece mais controle. Você gerencia o SO, o middleware e os aplicativos. Em vez disso, o Google gerencia a virtualização, os servidores, o armazenamento e a rede subjacentes. As soluções de IaaS disponíveis no Google Cloud incluem o seguinte:

  • Compute Engine: esse serviço permite criar e executar instâncias de VM e bare metal na infraestrutura do Google. O Compute Engine oferece flexibilidade para executar uma ampla variedade de cargas de trabalho, permitindo que você escolha entre várias séries de máquinas, serviços de armazenamento, aceleradores e SOs convidados.

  • Google Cloud VMware Engine: um serviço que permite migrar e executar cargas de trabalho VMware de forma nativa no Google Cloud. O Google gerencia o hardware subjacente e a plataforma VMware. Você mantém o controle total das VMs, dos SOs convidados e dos aplicativos. Essa abordagem ajuda você a migrar para a nuvem sem refazer a arquitetura dos ambientes VMware atuais.

A IaaS geralmente é preferida por arquitetos de infraestrutura, engenheiros de infraestrutura de ML e engenheiros de plataforma que precisam projetar e gerenciar ambientes personalizados do zero.

Plataformas e serviços gerenciados

Plataformas e serviços gerenciados oferecem um equilíbrio entre controle e facilidade de uso. O Google gerencia a infraestrutura subjacente, o SO e os ambientes de execução para que você possa se concentrar na execução das cargas de trabalho. As soluções gerenciadas que estão disponíveis no Google Cloud incluem o seguinte:

  • Batch: um serviço gerenciado que permite programar, enfileirar, e executar jobs de computação em lote em escala. O Batch provisiona recursos do Compute Engine para executar seus jobs e gerencia o ciclo de vida deles. Assim, você não precisa gerenciar diretamente as instâncias de VM ou bare metal subjacentes.

  • Cloud Run: uma plataforma totalmente gerenciada que permite desenvolver e implantar aplicativos conteinerizados altamente escalonáveis em uma infraestrutura sem servidor. Com o Cloud Run, você não precisa se preocupar com todo o gerenciamento da infraestrutura. Essa abstração permite executar contêineres que respondem a solicitações ou eventos da Web sem precisar gerenciar servidores ou clusters.

  • Cluster Director: um serviço gerenciado que automatiza a configuração complexa de clusters de IA, ML ou HPC. O Google gerencia a infraestrutura do cluster, permitindo que você se concentre na execução das cargas de trabalho com sobrecarga operacional mínima.

  • Cluster Toolkit: um kit de ferramentas de código aberto que ajuda a provisionar clusters de IA, ML ou HPC no Google Cloud usando blueprints predefinidos. Você gerencia a infraestrutura de cluster resultante, mas o kit de ferramentas abstrai o processo de implantação e permite personalizar as implantações e a pilha de software.

  • GKE: um ambiente gerenciado para executar aplicativos conteinerizados no Kubernetes. O Google gerencia o plano de controle do Kubernetes, enquanto você implanta e gerencia as cargas de trabalho de contêiner. Dependendo do modo de implantação (Autopilot ou Standard), você pode escolher o nível de controle que quer ter sobre a infraestrutura subjacente.

Plataformas e serviços gerenciados geralmente são preferidos por cientistas de dados, pesquisadores de IA e engenheiros de ML que querem provisionar recursos e implantar cargas de trabalho rapidamente sem gerenciamento de infraestrutura.

A seguir