Crea VMs de G4 optimizadas para IA de forma masiva

En este documento, se explica cómo crear instancias de máquina virtual (VM) de forma masiva que usen la serie de máquinas G4. Para obtener más información sobre estos tipos de máquinas optimizados para aceleradores, consulta la serie G4.

Para obtener más información sobre cómo crear VMs de forma masiva, consulta Acerca de la creación masiva de VMs en la documentación de Compute Engine.

Para obtener información sobre otras formas de crear VMs o clústeres, consulta la Descripción general de las opciones de implementación.

Limitaciones

Cuando creas VMs de G4 de forma masiva, se aplican las siguientes limitaciones:

Si deseas usar una política de posición compacta, revisa las restricciones para las políticas de posición.

Antes de comenzar

Antes de crear VMs de forma masiva, si aún no lo hiciste, completa los siguientes pasos:

  1. Elige una opción de consumo: La opción de consumo que elijas determinará cómo obtendrás y usarás los recursos de GPU. Para obtener más información, consulta Elige una opción de consumo.
  2. Obtén capacidad: El proceso para obtener capacidad difiere para cada opción de consumo. Para obtener información sobre el proceso para obtener capacidad para la opción de consumo que elegiste, consulta Descripción general de la capacidad.

Selecciona la pestaña que corresponda a la forma en que planeas usar las muestras de esta página:

Console

Cuando usas la consola de Google Cloud para acceder a los servicios y las APIs de Google Cloud , no necesitas configurar la autenticación.

gcloud

En la consola de Google Cloud , activa Cloud Shell.

Activa Cloud Shell

En la parte inferior de la consola de Google Cloud , se inicia una sesión de Cloud Shell en la que se muestra una ventana de línea de comandos. Cloud Shell es un entorno de shell con Google Cloud CLI ya instalada y con valores ya establecidos para el proyecto actual. La sesión puede tardar unos segundos en inicializarse.

REST

Para usar las muestras de la API de REST incluidas en esta página en un entorno de desarrollo local, debes usar las credenciales que proporciones a la gcloud CLI.

    Instala Google Cloud CLI.

    Si usas un proveedor de identidad externo (IdP), primero debes acceder a la gcloud CLI con tu identidad federada.

Para obtener más información, consulta Autentícate para usar REST en la documentación de autenticación de Google Cloud .

Roles obligatorios

Para obtener los permisos que necesitas para crear VMs de forma masiva, pídele a tu administrador que te otorgue el rol de IAM Administrador de instancias de Compute (v1) (roles/compute.instanceAdmin.v1) en el proyecto. Para obtener más información sobre cómo otorgar roles, consulta Administra el acceso a proyectos, carpetas y organizaciones.

Este rol predefinido contiene los permisos necesarios para crear VMs de forma masiva. Para ver los permisos exactos que son necesarios, expande la sección Permisos requeridos:

Permisos necesarios

Se requieren los siguientes permisos para crear VMs de forma masiva:

  • compute.instances.create en el proyecto
  • Si deseas usar una imagen personalizada para crear la VM, sigue estos pasos: compute.images.useReadOnly en la imagen
  • Para usar una instantánea a fin de crear la VM, haz lo siguiente: compute.snapshots.useReadOnly en la instantánea
  • Si quieres usar una plantilla de instancias para crear la VM, sigue estos pasos: compute.instanceTemplates.useReadOnly en la plantilla de instancias
  • A fin de especificar una subred para tu VM: compute.subnetworks.use en el proyecto o en la subred elegida
  • Si deseas especificar una dirección IP estática para la VM: compute.addresses.use en el proyecto
  • Para asignar una dirección IP externa a la VM cuando se usa una red de VPC, compute.subnetworks.useExternalIp en el proyecto o en la subred elegida.
  • Para asignar una red heredada a la VM, ejecuta compute.networks.use en el proyecto.
  • Para asignar una dirección IP externa a la VM cuando se usa una red heredada, ejecuta compute.networks.useExternalIp en el proyecto
  • Para configurar los metadatos de la instancia de VM para la VM, compute.instances.setMetadata en el proyecto.
  • Para configurar etiquetas en la VM, haz lo siguiente: compute.instances.setTags en la VM
  • Para configurar etiquetas en la VM, haz lo siguiente: compute.instances.setLabels en la VM
  • A fin de configurar una cuenta de servicio para que la VM use: compute.instances.setServiceAccount en la VM
  • Crear un disco nuevo para la VM: compute.disks.create en el proyecto
  • Para conectar un disco existente en modo de solo lectura o de lectura y escritura, usa compute.disks.use en el disco.
  • Para conectar un disco existente en modo de solo lectura, haz lo siguiente: compute.disks.useReadOnly en el disco

También puedes obtener estos permisos con roles personalizados o con otros roles predefinidos.

Descripción general

La creación masiva de instancias con el tipo de máquina G4 incluye los siguientes pasos:

  1. Opcional: Crea una política de posición compacta
  2. Crea instancias de forma masiva
  3. Instala controladores de GPU
  4. Opcional: Habilita el modo de GPU de varias instancias de NVIDIA

Opcional: Crea una política de posición compacta

Puedes especificar la posición de la VM creando una política de posición compacta. Cuando aplicas una política de posición compacta a tus VMs, Compute Engine hace su mejor esfuerzo para crear VMs que estén lo más cerca posible entre sí. Si tu aplicación es sensible a la latencia y requiere la máxima compactación, especifica el campo maxDistance (versión preliminar) cuando crees una política de posición compacta. Un valor de maxDistance más bajo garantiza una colocación más cercana de las VM, pero también aumenta la probabilidad de que no se creen algunas VMs.

Para crear una política de posición compacta, selecciona una de las siguientes opciones:

gcloud

Para crear una política de posición compacta, usa el comando gcloud beta compute resource-policies create group-placement:

gcloud beta compute resource-policies create group-placement POLICY_NAME \
    --collocation=collocated \
    --max-distance=MAX_DISTANCE \
    --region=REGION

Reemplaza lo siguiente:

  • POLICY_NAME: el nombre de la política de posición compacta.
  • MAX_DISTANCE: Es la configuración de distancia máxima para tus VMs, que se puede especificar (vista previa, recomendado) o no especificar (quita la marca --max-distance). Asegúrate de que la configuración de distancia máxima admita la serie de máquinas y la cantidad de VMs que planeas crear. Para obtener más información, consulta Acerca de las políticas de posición compacta en la documentación de Compute Engine. Por ejemplo, una distancia máxima de 3 coloca las VMs en bloques adyacentes y 2 coloca las VMs en el mismo bloque.
  • REGION: la región en la que deseas crear la política de posición compacta. Especifica la región que contiene la zona en la que planeas crear instancias y verifica que el tipo de máquina que deseas usar esté disponible en esa región. Para obtener información sobre las regiones, consulta Disponibilidad de GPU por regiones y zonas.

REST

Para crear una política de posición compacta, realiza una solicitud POST al método resourcePolicies.insert de la versión beta. En el cuerpo de la solicitud, incluye el campo collocation configurado como COLLOCATED y el campo maxDistance.

POST https://compute.googleapis.com/compute/beta/projects/PROJECT_ID/regions/REGION/resourcePolicies
  {
    "name": "POLICY_NAME",
    "groupPlacementPolicy": {
      "collocation": "COLLOCATED",
      "maxDistance": MAX_DISTANCE
    }
  }

Reemplaza lo siguiente:

  • PROJECT_ID: el ID de tu proyecto
  • POLICY_NAME: el nombre de la política de posición compacta.
  • MAX_DISTANCE: Es la configuración de distancia máxima para tus VMs, que se puede especificar (vista previa, recomendada) o no especificar (quitar el campo maxDistance). Asegúrate de que la configuración de distancia máxima admita la serie de máquinas y la cantidad de VMs que planeas crear. Para obtener más información, consulta Acerca de las políticas de posición compacta en la documentación de Compute Engine. Por ejemplo, una distancia máxima de 3 coloca las VMs en bloques adyacentes y 2 coloca las VMs en el mismo bloque.
  • REGION: la región en la que deseas crear la política de posición compacta. Especifica la región que contiene la zona en la que planeas crear instancias y verifica que el tipo de máquina que deseas usar esté disponible en esa región. Para obtener información sobre las regiones, consulta Disponibilidad de GPU por regiones y zonas.

Crea VMs de G4 de forma masiva

Para crear VMs de G4 de forma masiva, usa uno de los siguientes métodos.

Los siguientes comandos también establecen el permiso de acceso para tus instancias. Para simplificar la administración de permisos, Google recomienda que configures el permiso de acceso en una instancia como acceso cloud-platform y, luego, uses roles de IAM para definir a qué servicios puede acceder la instancia. Para obtener más información, consulta las prácticas recomendadas para los permisos.

gcloud

Para crear instancias de forma masiva, usa el comando gcloud compute instances bulk create.

Los parámetros que debes especificar dependen de la opción de consumo que uses para esta implementación. Selecciona la pestaña que corresponda a tu opción de consumo.

Reserva

Las instancias G4 admiten los siguientes tipos de reservas:

  • Reservas según demanda
  • Reservas futuras estándar

Para consumir estos tipos de reservas, una instancia debe usar el modelo de aprovisionamiento estándar. Por ejemplo, usa los siguientes parámetros de creación.

Antes de ejecutar el comando, revisa todos los pasos que se indican a continuación para determinar si debes incluir marcas adicionales.

gcloud compute instances bulk create \
    --name-pattern=NAME_PATTERN \
    --count=COUNT \
     --machine-type=MACHINE_TYPE \
    --image-family=IMAGE_FAMILY \
    --image-project=IMAGE_PROJECT \
    --region=REGION \
    --boot-disk-type=hyperdisk-balanced \
    --boot-disk-size=DISK_SIZE \
    --scopes=cloud-platform \
    --provisioning-model=STANDARD \
    --maintenance-policy=TERMINATE \
    --reservation-affinity=RESERVATION_AFFINITY \
    --reservation=RESERVATION

Completa los siguientes pasos:

  1. Reemplaza lo siguiente:

    • NAME_PATTERN: Es el patrón de nombres que se usará para las instancias de G4. Por ejemplo, si usas instance-# para el patrón de nombre, se generan instancias G4 con nombres como instance-1 y instance-2, hasta la cantidad de instancias G4 especificadas por --count.
    • COUNT: Es la cantidad de instancias de G4 que se crearán.
    • MACHINE_TYPE: Es el tipo de máquina que se usará para la instancia G4. Para obtener más información, consulta Tipos de máquinas con GPU en la documentación de Compute Engine.
    • IMAGE_FAMILY: Es la familia de imágenes de la imagen de SO que deseas usar. Para obtener una lista de todos los sistemas operativos compatibles, consulta Sistemas operativos compatibles.
    • IMAGE_PROJECT: Es el ID del proyecto de la imagen de SO.
    • REGION: Especifica una región en la que esté disponible el tipo de máquina que deseas usar. Si deseas especificar una política de posición compacta, debes usar la misma región que la política de posición compacta. Para obtener información sobre las regiones, consulta Disponibilidad de GPU por regiones y zonas.
    • DISK_SIZE: Es el tamaño del disco de arranque en GB. Para obtener más información, consulta Límites de tamaño de Google Cloud Hyperdisk o Límites de tamaño de Persistent Disk, según el tipo de disco.
    • RESERVATION_AFFINITY: Indica qué reservas puede consumir la instancia, si es posible. Especifica una de las siguientes opciones:

      • any (la capacidad de reserva es opcional): Esta es la opción predeterminada. La instancia intenta usar capacidad de una reserva de consumo automático, lo que solo sucede si hay capacidad de reserva coincidente disponible. De lo contrario, la instancia usa capacidad a pedido.

      • specific (Se requiere capacidad de reserva): Requiere que la instancia use capacidad de una reserva orientada específicamente. La instancia no puede usar la capacidad según demanda. Si la capacidad de reserva no está disponible, la creación de la instancia fallará.

    • RESERVATION: Es la reserva que se usará. Especifica una de las siguientes opciones según el valor que especificaste para RESERVATION_AFFINITY:

      • Si especificaste any, reemplaza RESERVATION por una cadena vacía (""). Como alternativa, puedes quitar la marca --reservation por completo.
      • Si especificaste specific, reemplaza RESERVATION por lo siguiente:

        projects/RESERVATION_OWNER_PROJECT_ID/reservations/RESERVATION_NAME

        Reemplaza lo siguiente:

        • RESERVATION_OWNER_PROJECT_ID: Es el ID del proyecto en el que se creó la reserva.
        • RESERVATION_NAME por el nombre de la reserva.
  2. De forma predeterminada, la instancia se reinicia automáticamente si falla o si Compute Engine la detiene por una detención programada, como un evento de mantenimiento. Si quieres inhabilitar el reinicio automático, agrega la siguiente marca:

    --no-restart-on-failure
  3. Opcional: Si elegiste usar una política de posición compacta, agrega la siguiente marca al comando:

    --resource-policies=POLICY_NAME
    

    Reemplaza lo siguiente:

    • POLICY_NAME: el nombre de la política de posición compacta.
  4. Opcional: Para conectar discos SSD locales, agrega la siguiente marca --local-ssd para cada disco SSD local.

    Asegúrate de que la cantidad de discos SSD locales que conectes esté permitida para tu tipo de máquina. Para obtener más detalles, consulta Acerca de los discos SSD locales en la documentación de Compute Engine. Específicamente, los tipos de máquinas G4 usan discos SSD de Titanium.

    --local-ssd interface=INTERFACE_TYPE
    

    Reemplaza lo siguiente:

    • INTERFACE_TYPE: Es el tipo de interfaz de disco que deseas usar para el disco SSD local. Si tu imagen de disco de arranque tiene controladores NVMe optimizados, especifica NVME. Especifica SCSI para otras imágenes.

    Después de crear una VM con discos SSD locales, debes formatear y activar cada dispositivo antes de poder usarlo.

  5. Opcional: Para usar la estación de trabajo virtual (vWS) NVIDIA RTX, agrega la siguiente marca.

    Cuando creas una instancia que usa la estación de trabajo virtual NVIDIA RTX, Compute Engine agrega automáticamente una licencia de vWS. Para obtener información sobre los precios de las estaciones de trabajo virtuales, consulta la página de precios de GPU.

    --accelerator=type=nvidia-rtx-pro-6000-vws,count=VWS_ACCELERATOR_COUNT
    

    Reemplaza VWS_ACCELERATOR_COUNT por la cantidad de GPU virtuales que deseas.

  6. Ejecute el comando.

A pedido

Antes de ejecutar el comando, revisa todos los pasos que se indican a continuación para determinar si debes incluir marcas adicionales.

gcloud compute instances bulk create \
    --name-pattern=NAME_PATTERN \
    --count=COUNT \
     --machine-type=MACHINE_TYPE \
    --image-family=IMAGE_FAMILY \
    --image-project=IMAGE_PROJECT \
    --region=REGION \
    --boot-disk-type=hyperdisk-balanced \
    --boot-disk-size=DISK_SIZE \
    --scopes=cloud-platform \
    --provisioning-model=STANDARD \
    --maintenance-policy=TERMINATE \
    --reservation-affinity=RESERVATION_AFFINITY

Completa los siguientes pasos:

  1. Reemplaza lo siguiente:

    • NAME_PATTERN: Es el patrón de nombres que se usará para las instancias de G4. Por ejemplo, si usas instance-# para el patrón de nombre, se generan instancias G4 con nombres como instance-1 y instance-2, hasta la cantidad de instancias G4 especificadas por --count.
    • COUNT: Es la cantidad de instancias de G4 que se crearán.
    • MACHINE_TYPE: Es el tipo de máquina que se usará para la instancia G4. Para obtener más información, consulta Tipos de máquinas con GPU en la documentación de Compute Engine.
    • IMAGE_FAMILY: Es la familia de imágenes de la imagen de SO que deseas usar. Para obtener una lista de todos los sistemas operativos compatibles, consulta Sistemas operativos compatibles.
    • IMAGE_PROJECT: Es el ID del proyecto de la imagen de SO.
    • REGION: Especifica una región en la que esté disponible el tipo de máquina que deseas usar. Si deseas especificar una política de posición compacta, debes usar la misma región que la política de posición compacta. Para obtener información sobre las regiones, consulta Disponibilidad de GPU por regiones y zonas.
    • DISK_SIZE: Es el tamaño del disco de arranque en GB. Para obtener más información, consulta Límites de tamaño de Google Cloud Hyperdisk o Límites de tamaño de Persistent Disk, según el tipo de disco.
    • RESERVATION_AFFINITY: Indica qué reservas puede consumir la instancia, si es posible. Especifica una de las siguientes opciones:

      • any (la capacidad de reserva es opcional): Esta es la opción predeterminada. La instancia intenta usar capacidad de una reserva de consumo automático, lo que solo sucede si hay capacidad de reserva coincidente disponible. De lo contrario, la instancia usa capacidad a pedido.

      • none (Se requiere capacidad según demanda): Bloquea la instancia para que no use ninguna capacidad de reserva.

  2. De forma predeterminada, la instancia se reinicia automáticamente si falla o si Compute Engine la detiene por una detención programada, como un evento de mantenimiento. Si quieres inhabilitar el reinicio automático, agrega la siguiente marca:

    --no-restart-on-failure
  3. Opcional: Si elegiste usar una política de posición compacta, agrega la siguiente marca al comando:

    --resource-policies=POLICY_NAME
    

    Reemplaza lo siguiente:

    • POLICY_NAME: el nombre de la política de posición compacta.
  4. Opcional: Para conectar discos SSD locales, agrega la siguiente marca --local-ssd para cada disco SSD local.

    Asegúrate de que la cantidad de discos SSD locales que conectes esté permitida para tu tipo de máquina. Para obtener más detalles, consulta Acerca de los discos SSD locales en la documentación de Compute Engine. Específicamente, los tipos de máquinas G4 usan discos SSD de Titanium.

    --local-ssd interface=INTERFACE_TYPE
    

    Reemplaza lo siguiente:

    • INTERFACE_TYPE: Es el tipo de interfaz de disco que deseas usar para el disco SSD local. Si tu imagen de disco de arranque tiene controladores NVMe optimizados, especifica NVME. Especifica SCSI para otras imágenes.

    Después de crear una VM con discos SSD locales, debes formatear y activar cada dispositivo antes de poder usarlo.

  5. Opcional: Para usar la estación de trabajo virtual (vWS) NVIDIA RTX, agrega la siguiente marca.

    Cuando creas una instancia que usa la estación de trabajo virtual NVIDIA RTX, Compute Engine agrega automáticamente una licencia de vWS. Para obtener información sobre los precios de las estaciones de trabajo virtuales, consulta la página de precios de GPU.

    --accelerator=type=nvidia-rtx-pro-6000-vws,count=VWS_ACCELERATOR_COUNT
    

    Reemplaza VWS_ACCELERATOR_COUNT por la cantidad de GPU virtuales que deseas.

  6. Ejecute el comando.

Spot

Antes de ejecutar el comando, revisa todos los pasos que se indican a continuación para determinar si debes incluir marcas adicionales.

gcloud compute instances bulk create \
    --name-pattern=NAME_PATTERN \
    --count=COUNT \
     --machine-type=MACHINE_TYPE \
    --image-family=IMAGE_FAMILY \
    --image-project=IMAGE_PROJECT \
    --region=REGION \
    --boot-disk-type=hyperdisk-balanced \
    --boot-disk-size=DISK_SIZE \
    --scopes=cloud-platform \
    --provisioning-model=SPOT \
    --instance-termination-action=TERMINATION_ACTION \
    --maintenance-policy=TERMINATE \
    --no-restart-on-failure

Completa los siguientes pasos:

  1. Reemplaza lo siguiente:

    • NAME_PATTERN: Es el patrón de nombres que se usará para las instancias de G4. Por ejemplo, si usas instance-# para el patrón de nombre, se generan instancias G4 con nombres como instance-1 y instance-2, hasta la cantidad de instancias G4 especificadas por --count.
    • COUNT: Es la cantidad de instancias de G4 que se crearán.
    • MACHINE_TYPE: Es el tipo de máquina que se usará para la instancia G4. Para obtener más información, consulta Tipos de máquinas con GPU en la documentación de Compute Engine.
    • IMAGE_FAMILY: Es la familia de imágenes de la imagen de SO que deseas usar. Para obtener una lista de todos los sistemas operativos compatibles, consulta Sistemas operativos compatibles.
    • IMAGE_PROJECT: Es el ID del proyecto de la imagen de SO.
    • REGION: Especifica una región en la que esté disponible el tipo de máquina que deseas usar. Si deseas especificar una política de posición compacta, debes usar la misma región que la política de posición compacta. Para obtener información sobre las regiones, consulta Disponibilidad de GPU por regiones y zonas.
    • DISK_SIZE: Es el tamaño del disco de arranque en GB. Para obtener más información, consulta Límites de tamaño de Google Cloud Hyperdisk o Límites de tamaño de Persistent Disk, según el tipo de disco.
    • TERMINATION_ACTION: Es la acción que se debe realizar cuando Compute Engine interrumpe la instancia, ya sea STOP (predeterminada) o DELETE.

  2. Opcional: Si elegiste usar una política de posición compacta, agrega la siguiente marca al comando:

    --resource-policies=POLICY_NAME
    

    Reemplaza lo siguiente:

    • POLICY_NAME: el nombre de la política de posición compacta.
  3. Opcional: Para conectar discos SSD locales, agrega la siguiente marca --local-ssd para cada disco SSD local.

    Asegúrate de que la cantidad de discos SSD locales que conectes esté permitida para tu tipo de máquina. Para obtener más detalles, consulta Acerca de los discos SSD locales en la documentación de Compute Engine. Específicamente, los tipos de máquinas G4 usan discos SSD de Titanium.

    --local-ssd interface=INTERFACE_TYPE
    

    Reemplaza lo siguiente:

    • INTERFACE_TYPE: Es el tipo de interfaz de disco que deseas usar para el disco SSD local. Si tu imagen de disco de arranque tiene controladores NVMe optimizados, especifica NVME. Especifica SCSI para otras imágenes.

    Después de crear una VM con discos SSD locales, debes formatear y activar cada dispositivo antes de poder usarlo.

  4. Opcional: Para usar la estación de trabajo virtual (vWS) NVIDIA RTX, agrega la siguiente marca.

    Cuando creas una instancia que usa la estación de trabajo virtual NVIDIA RTX, Compute Engine agrega automáticamente una licencia de vWS. Para obtener información sobre los precios de las estaciones de trabajo virtuales, consulta la página de precios de GPU.

    --accelerator=type=nvidia-rtx-pro-6000-vws,count=VWS_ACCELERATOR_COUNT
    

    Reemplaza VWS_ACCELERATOR_COUNT por la cantidad de GPU virtuales que deseas.

  5. Ejecute el comando.

REST

Para crear instancias de forma masiva, realiza una solicitud POST al método instances.bulkInsert.

Los parámetros que debes especificar dependen de la opción de consumo que uses para esta implementación. Selecciona la pestaña que corresponda a tu opción de consumo.

Reserva

Las instancias G4 admiten los siguientes tipos de reservas:

  • Reservas según demanda
  • Reservas futuras estándar

Para consumir estos tipos de reservas, una instancia debe usar el modelo de aprovisionamiento estándar. Por ejemplo, usa los siguientes parámetros de creación.

Antes de enviar la solicitud, revisa todos los pasos que se indican a continuación para determinar si debes incluir campos adicionales.

POST https://compute.googleapis.com/compute/v1/projects/PROJECT_ID/zones/ZONE/instances/bulkInsert
{
  "namePattern": "NAME_PATTERN",
  "count": "COUNT",
  "instanceProperties": {
    "machineType": "MACHINE_TYPE",
    "disks": [
      {
        "boot": true,
        "initializeParams": {
          "diskSizeGb": "DISK_SIZE",
          "diskType": "hyperdisk-balanced",
          "sourceImage": "projects/IMAGE_PROJECT/global/images/family/IMAGE_FAMILY"
        },
        "mode": "READ_WRITE",
        "type": "PERSISTENT"
      }
    ],
    "serviceAccounts": [
      {
        "email": "default",
        "scopes": [
          "https://www.googleapis.com/auth/cloud-platform"
        ]
      }
    ],
    "scheduling": {
    "provisioningModel": "STANDARD",
    "onHostMaintenance": "TERMINATE",
    "automaticRestart": AUTOMATIC_RESTART
  },
  "reservationAffinity": {
    "consumeReservationType": "RESERVATION_AFFINITY",
    "key": "compute.googleapis.com/reservation-name",
    "values": [
      "RESERVATION"
    ]
  }
  }
}

Completa los siguientes pasos:

  1. Reemplaza lo siguiente:

    • PROJECT_ID: ID del proyecto en el que deseas crear la instancia de G4.
    • ZONE: Especifica una zona en la que esté disponible el tipo de máquina que deseas usar. Si deseas especificar una política de posición compacta, debes usar una zona en la misma región que la política de posición compacta. Para obtener información sobre las regiones, consulta Disponibilidad de GPU por regiones y zonas.
    • NAME_PATTERN: Es el patrón de nombres que se usará para las instancias de G4. Por ejemplo, si usas instance-# para el patrón de nombre, se generan instancias G4 con nombres como instance-1 y instance-2, hasta la cantidad de instancias G4 especificadas por --count.
    • COUNT: Es la cantidad de instancias de G4 que se crearán.
    • MACHINE_TYPE: Es el tipo de máquina que se usará para la instancia G4. Para obtener más información, consulta Tipos de máquinas con GPU en la documentación de Compute Engine.
    • DISK_SIZE: Es el tamaño del disco de arranque en GB. Para obtener más información, consulta Límites de tamaño de Google Cloud Hyperdisk o Límites de tamaño de Persistent Disk, según el tipo de disco.
    • IMAGE_PROJECT: Es el ID del proyecto de la imagen de SO.
    • IMAGE_FAMILY: Es la familia de imágenes de la imagen de SO que deseas usar. Para obtener una lista de todos los sistemas operativos compatibles, consulta Sistemas operativos compatibles.
    • AUTOMATIC_RESTART: Indica si la instancia se reinicia automáticamente si falla o si Compute Engine la detiene por una detención programada, como un evento de mantenimiento. Especifica true para habilitar el reinicio automático (predeterminado) o false para inhabilitarlo.

    • RESERVATION_AFFINITY: Indica qué reservas puede consumir la instancia, si es posible. Especifica una de las siguientes opciones:

      • ANY_RESERVATION (la capacidad de reserva es opcional): Esta es la opción predeterminada. La instancia intenta usar capacidad de una reserva que se consume automáticamente, lo que solo sucede si hay capacidad de reserva coincidente disponible. De lo contrario, la instancia usa capacidad a pedido.

      • SPECIFIC_RESERVATION (Se requiere capacidad de reserva): Requiere que la instancia use capacidad de una reserva orientada específicamente. La instancia no puede usar la capacidad según demanda. Si la capacidad de reserva no está disponible, la creación de la instancia fallará.

    • RESERVATION: Es la reserva que se usará. Especifica una de las siguientes opciones según el valor que especificaste para RESERVATION_AFFINITY:

      • Si especificaste ANY_RESERVATION, borra RESERVATION para que el valor sea una cadena vacía (""). Como alternativa, puedes quitar por completo los campos key y values.
      • Si especificaste SPECIFIC_RESERVATION, reemplaza RESERVATION por lo siguiente:

        projects/RESERVATION_OWNER_PROJECT_ID/reservations/RESERVATION_NAME

        Reemplaza lo siguiente:

        • RESERVATION_OWNER_PROJECT_ID: Es el ID del proyecto en el que se creó la reserva.
        • RESERVATION_NAME por el nombre de la reserva.
  2. Opcional: Si elegiste usar una política de posición compacta, agrega el siguiente subcampo instanceProperties al cuerpo de la solicitud:

        "resourcePolicies": [
          "projects/PROJECT_ID/regions/REGION/resourcePolicies/POLICY_NAME"
        ]
    

    Reemplaza lo siguiente:

    • PROJECT_ID: Es el ID del proyecto de la política de posición compacta.
    • REGION: Es la región de la política de posición compacta.
    • POLICY_NAME: el nombre de la política de posición compacta.
  3. Opcional: Para usar discos SSD locales, agrega el siguiente campo al campo disks[] para cada disco SSD local. Separa cada subcampo disks[] (incluido el disco de arranque) con una coma.

    Asegúrate de que la cantidad de discos SSD locales que conectes esté permitida para tu tipo de máquina. Para obtener más detalles, consulta Acerca de los discos SSD locales en la documentación de Compute Engine. Específicamente, los tipos de máquinas G4 usan discos SSD de Titanium.

        {
           "type": "SCRATCH",
           "initializeParams": {
              "diskType": "zones/ZONE/diskTypes/local-ssd"
           },
           "autoDelete": true,
           "interface": "INTERFACE_TYPE"
        }
    

    Reemplaza lo siguiente:

    • ZONE: La zona que especificaste.
    • INTERFACE_TYPE: Es el tipo de interfaz de disco que deseas usar para el disco SSD local. Si tu imagen de disco de arranque tiene controladores NVMe optimizados, especifica NVME. Especifica SCSI para otras imágenes.

    Después de crear una VM con discos SSD locales, debes formatear y activar cada dispositivo antes de poder usarlo.

  4. Opcional: Para usar la estación de trabajo virtual (vWS) NVIDIA RTX, agrega el siguiente campo.

    Cuando creas una instancia que usa la estación de trabajo virtual NVIDIA RTX, Compute Engine agrega automáticamente una licencia de vWS. Para obtener información sobre los precios de las estaciones de trabajo virtuales, consulta la página de precios de GPU.

    "guestAccelerators":
      [
        {
          "acceleratorCount": VWS_ACCELERATOR_COUNT,
          "acceleratorType": "projects/PROJECT_ID/zones/ZONE/acceleratorTypes/nvidia-rtx-pro-6000-vws"
        }
      ]
    

    Reemplaza VWS_ACCELERATOR_COUNT por la cantidad de GPU virtuales que deseas.

  5. Envía la solicitud.

A pedido

Antes de enviar la solicitud, revisa todos los pasos que se indican a continuación para determinar si debes incluir campos adicionales.

POST https://compute.googleapis.com/compute/v1/projects/PROJECT_ID/zones/ZONE/instances/bulkInsert
{
  "namePattern": "NAME_PATTERN",
  "count": "COUNT",
  "instanceProperties": {
    "machineType": "MACHINE_TYPE",
    "disks": [
      {
        "boot": true,
        "initializeParams": {
          "diskSizeGb": "DISK_SIZE",
          "diskType": "hyperdisk-balanced",
          "sourceImage": "projects/IMAGE_PROJECT/global/images/family/IMAGE_FAMILY"
        },
        "mode": "READ_WRITE",
        "type": "PERSISTENT"
      }
    ],
    "serviceAccounts": [
      {
        "email": "default",
        "scopes": [
          "https://www.googleapis.com/auth/cloud-platform"
        ]
      }
    ],
    "scheduling": {
    "provisioningModel": "STANDARD",
    "onHostMaintenance": "TERMINATE",
    "automaticRestart": AUTOMATIC_RESTART
  },
  "reservationAffinity": {
    "consumeReservationType": "RESERVATION_AFFINITY"
  }
  }
}

Completa los siguientes pasos:

  1. Reemplaza lo siguiente:

    • PROJECT_ID: ID del proyecto en el que deseas crear la instancia de G4.
    • ZONE: Especifica una zona en la que esté disponible el tipo de máquina que deseas usar. Si deseas especificar una política de posición compacta, debes usar una zona en la misma región que la política de posición compacta. Para obtener información sobre las regiones, consulta Disponibilidad de GPU por regiones y zonas.
    • NAME_PATTERN: Es el patrón de nombres que se usará para las instancias de G4. Por ejemplo, si usas instance-# para el patrón de nombre, se generan instancias G4 con nombres como instance-1 y instance-2, hasta la cantidad de instancias G4 especificadas por --count.
    • COUNT: Es la cantidad de instancias de G4 que se crearán.
    • MACHINE_TYPE: Es el tipo de máquina que se usará para la instancia G4. Para obtener más información, consulta Tipos de máquinas con GPU en la documentación de Compute Engine.
    • DISK_SIZE: Es el tamaño del disco de arranque en GB. Para obtener más información, consulta Límites de tamaño de Google Cloud Hyperdisk o Límites de tamaño de Persistent Disk, según el tipo de disco.
    • IMAGE_PROJECT: Es el ID del proyecto de la imagen de SO.
    • IMAGE_FAMILY: Es la familia de imágenes de la imagen de SO que deseas usar. Para obtener una lista de todos los sistemas operativos compatibles, consulta Sistemas operativos compatibles.
    • AUTOMATIC_RESTART: Indica si la instancia se reinicia automáticamente si falla o si Compute Engine la detiene por una detención programada, como un evento de mantenimiento. Especifica true para habilitar el reinicio automático (predeterminado) o false para inhabilitarlo.

    • RESERVATION_AFFINITY: Indica qué reservas puede consumir la instancia, si es posible. Especifica una de las siguientes opciones:

      • ANY_RESERVATION (la capacidad de reserva es opcional): Esta es la opción predeterminada. La instancia intenta usar capacidad de una reserva que se consume automáticamente, lo que solo sucede si hay capacidad de reserva coincidente disponible. De lo contrario, la instancia usa capacidad a pedido.

      • NO_RESERVATION (Se requiere capacidad según demanda): Bloquea la instancia para que no use ninguna capacidad de reserva.

  2. Opcional: Si elegiste usar una política de posición compacta, agrega el siguiente subcampo instanceProperties al cuerpo de la solicitud:

        "resourcePolicies": [
          "projects/PROJECT_ID/regions/REGION/resourcePolicies/POLICY_NAME"
        ]
    

    Reemplaza lo siguiente:

    • PROJECT_ID: Es el ID del proyecto de la política de posición compacta.
    • REGION: Es la región de la política de posición compacta.
    • POLICY_NAME: el nombre de la política de posición compacta.
  3. Opcional: Para usar discos SSD locales, agrega el siguiente campo al campo disks[] para cada disco SSD local. Separa cada subcampo disks[] (incluido el disco de arranque) con una coma.

    Asegúrate de que la cantidad de discos SSD locales que conectes esté permitida para tu tipo de máquina. Para obtener más detalles, consulta Acerca de los discos SSD locales en la documentación de Compute Engine. Específicamente, los tipos de máquinas G4 usan discos SSD de Titanium.

        {
           "type": "SCRATCH",
           "initializeParams": {
              "diskType": "zones/ZONE/diskTypes/local-ssd"
           },
           "autoDelete": true,
           "interface": "INTERFACE_TYPE"
        }
    

    Reemplaza lo siguiente:

    • ZONE: La zona que especificaste.
    • INTERFACE_TYPE: Es el tipo de interfaz de disco que deseas usar para el disco SSD local. Si tu imagen de disco de arranque tiene controladores NVMe optimizados, especifica NVME. Especifica SCSI para otras imágenes.

    Después de crear una VM con discos SSD locales, debes formatear y activar cada dispositivo antes de poder usarlo.

  4. Opcional: Para usar la estación de trabajo virtual (vWS) NVIDIA RTX, agrega el siguiente campo.

    Cuando creas una instancia que usa la estación de trabajo virtual NVIDIA RTX, Compute Engine agrega automáticamente una licencia de vWS. Para obtener información sobre los precios de las estaciones de trabajo virtuales, consulta la página de precios de GPU.

    "guestAccelerators":
      [
        {
          "acceleratorCount": VWS_ACCELERATOR_COUNT,
          "acceleratorType": "projects/PROJECT_ID/zones/ZONE/acceleratorTypes/nvidia-rtx-pro-6000-vws"
        }
      ]
    

    Reemplaza VWS_ACCELERATOR_COUNT por la cantidad de GPU virtuales que deseas.

  5. Envía la solicitud.

Spot

Antes de enviar la solicitud, revisa todos los pasos que se indican a continuación para determinar si debes incluir campos adicionales.

POST https://compute.googleapis.com/compute/v1/projects/PROJECT_ID/zones/ZONE/instances/bulkInsert
{
  "namePattern": "NAME_PATTERN",
  "count": "COUNT",
  "instanceProperties": {
    "machineType": "MACHINE_TYPE",
    "disks": [
      {
        "boot": true,
        "initializeParams": {
          "diskSizeGb": "DISK_SIZE",
          "diskType": "hyperdisk-balanced",
          "sourceImage": "projects/IMAGE_PROJECT/global/images/family/IMAGE_FAMILY"
        },
        "mode": "READ_WRITE",
        "type": "PERSISTENT"
      }
    ],
    "serviceAccounts": [
      {
        "email": "default",
        "scopes": [
          "https://www.googleapis.com/auth/cloud-platform"
        ]
      }
    ],
    "scheduling":
    {
      "provisioningModel": "SPOT",
      "instanceTerminationAction": "TERMINATION_ACTION",
      "onHostMaintenance": "TERMINATE",
      "automaticRestart": false
    }
  }
}

Completa los siguientes pasos:

  1. Reemplaza lo siguiente:

    • PROJECT_ID: ID del proyecto en el que deseas crear la instancia de G4.
    • ZONE: Especifica una zona en la que esté disponible el tipo de máquina que deseas usar. Si deseas especificar una política de posición compacta, debes usar una zona en la misma región que la política de posición compacta. Para obtener información sobre las regiones, consulta Disponibilidad de GPU por regiones y zonas.
    • NAME_PATTERN: Es el patrón de nombres que se usará para las instancias de G4. Por ejemplo, si usas instance-# para el patrón de nombre, se generan instancias G4 con nombres como instance-1 y instance-2, hasta la cantidad de instancias G4 especificadas por --count.
    • COUNT: Es la cantidad de instancias de G4 que se crearán.
    • MACHINE_TYPE: Es el tipo de máquina que se usará para la instancia G4. Para obtener más información, consulta Tipos de máquinas con GPU en la documentación de Compute Engine.
    • DISK_SIZE: Es el tamaño del disco de arranque en GB. Para obtener más información, consulta Límites de tamaño de Google Cloud Hyperdisk o Límites de tamaño de Persistent Disk, según el tipo de disco.
    • IMAGE_PROJECT: Es el ID del proyecto de la imagen de SO.
    • IMAGE_FAMILY: Es la familia de imágenes de la imagen de SO que deseas usar. Para obtener una lista de todos los sistemas operativos compatibles, consulta Sistemas operativos compatibles.
    • TERMINATION_ACTION: Es la acción que se debe realizar cuando Compute Engine interrumpe la instancia, ya sea STOP (predeterminada) o DELETE.

  2. Opcional: Si elegiste usar una política de posición compacta, agrega el siguiente subcampo instanceProperties al cuerpo de la solicitud:

        "resourcePolicies": [
          "projects/PROJECT_ID/regions/REGION/resourcePolicies/POLICY_NAME"
        ]
    

    Reemplaza lo siguiente:

    • PROJECT_ID: Es el ID del proyecto de la política de posición compacta.
    • REGION: Es la región de la política de posición compacta.
    • POLICY_NAME: el nombre de la política de posición compacta.
  3. Opcional: Para usar discos SSD locales, agrega el siguiente campo al campo disks[] para cada disco SSD local. Separa cada subcampo disks[] (incluido el disco de arranque) con una coma.

    Asegúrate de que la cantidad de discos SSD locales que conectes esté permitida para tu tipo de máquina. Para obtener más detalles, consulta Acerca de los discos SSD locales en la documentación de Compute Engine. Específicamente, los tipos de máquinas G4 usan discos SSD de Titanium.

        {
           "type": "SCRATCH",
           "initializeParams": {
              "diskType": "zones/ZONE/diskTypes/local-ssd"
           },
           "autoDelete": true,
           "interface": "INTERFACE_TYPE"
        }
    

    Reemplaza lo siguiente:

    • ZONE: La zona que especificaste.
    • INTERFACE_TYPE: Es el tipo de interfaz de disco que deseas usar para el disco SSD local. Si tu imagen de disco de arranque tiene controladores NVMe optimizados, especifica NVME. Especifica SCSI para otras imágenes.

    Después de crear una VM con discos SSD locales, debes formatear y activar cada dispositivo antes de poder usarlo.

  4. Opcional: Para usar la estación de trabajo virtual (vWS) NVIDIA RTX, agrega el siguiente campo.

    Cuando creas una instancia que usa la estación de trabajo virtual NVIDIA RTX, Compute Engine agrega automáticamente una licencia de vWS. Para obtener información sobre los precios de las estaciones de trabajo virtuales, consulta la página de precios de GPU.

    "guestAccelerators":
      [
        {
          "acceleratorCount": VWS_ACCELERATOR_COUNT,
          "acceleratorType": "projects/PROJECT_ID/zones/ZONE/acceleratorTypes/nvidia-rtx-pro-6000-vws"
        }
      ]
    

    Reemplaza VWS_ACCELERATOR_COUNT por la cantidad de GPU virtuales que deseas.

  5. Envía la solicitud.

Para obtener más información sobre las opciones de configuración cuando creas VMs de forma masiva, consulta Crea VMs de forma masiva en la documentación de Compute Engine.

Instalar los controladores de GPU.

Después de crear una instancia, esta no puede usar sus GPUs a menos que ya estén instalados los controladores de GPU correctos. El controlador que debes instalar depende de si la instancia tiene GPUs fraccionarias o si tiene habilitada la estación de trabajo virtual (vWS) NVIDIA RTX. Usa una de las siguientes opciones:

Opcional: Habilita el modo de GPU de varias instancias de NVIDIA

El modo de GPU de instancias múltiples (MIG) es una función que puedes habilitar para una GPU de NVIDIA compatible. Después de crear una instancia, puedes habilitar el modo de MIG en una sola GPU conectada a tu máquina. Con el modo MIG habilitado, la GPU única se particiona en hasta siete instancias de GPU independientes. Cada instancia se ejecuta de manera simultánea, cada una con su propia memoria, caché y multiprocesadores de transmisión. Luego, puedes ejecutar diferentes cargas de trabajo en estas instancias de GPU en paralelo. El modo MIG es distinto del uso de tipos de máquinas G4 que tienen GPU fraccionarias conectadas, en el que varias cargas de trabajo comparten el acceso a una sola GPU física a través de la partición fraccionaria (GPU virtuales). Para obtener más información sobre el uso del modo MIG, consulta la Guía del usuario de GPU de instancias múltiples (MIG) en la documentación de NVIDIA.

¿Qué sigue?