Crea VMs N1 optimizadas para IA con GPUs de forma masiva

En este documento, se explica cómo crear instancias de máquina virtual (VM) de forma masiva que usen la serie de máquinas N1 con GPUs conectadas. Para obtener más información sobre estos tipos de máquinas optimizados para aceleradores, consulta Serie N1+GPU.

Para obtener más información sobre cómo crear VMs de forma masiva, consulta Acerca de la creación masiva de VMs en la documentación de Compute Engine.

Para obtener información sobre otras formas de crear VMs o clústeres, consulta la Descripción general de las opciones de implementación.

Limitaciones

Para conocer las limitaciones que se aplican a los tipos de máquinas N1 con GPU, consulta lo siguiente:

Antes de comenzar

Antes de crear VMs de forma masiva, si aún no lo hiciste, completa los siguientes pasos:

  1. Elige una opción de consumo: La opción de consumo que elijas determinará cómo obtendrás y usarás los recursos de GPU. Para obtener más información, consulta Elige una opción de consumo.
  2. Obtén capacidad: El proceso para obtener capacidad difiere para cada opción de consumo. Para obtener información sobre el proceso para obtener capacidad para la opción de consumo que elegiste, consulta Descripción general de la capacidad.

Selecciona la pestaña que corresponda a la forma en que planeas usar las muestras de esta página:

Console

Cuando usas la consola de Google Cloud para acceder a los servicios y las APIs de Google Cloud , no necesitas configurar la autenticación.

gcloud

En la consola de Google Cloud , activa Cloud Shell.

Activa Cloud Shell

En la parte inferior de la consola de Google Cloud , se inicia una sesión de Cloud Shell en la que se muestra una ventana de línea de comandos. Cloud Shell es un entorno de shell con Google Cloud CLI ya instalada y con valores ya establecidos para el proyecto actual. La sesión puede tardar unos segundos en inicializarse.

REST

Para usar las muestras de la API de REST incluidas en esta página en un entorno de desarrollo local, debes usar las credenciales que proporciones a la gcloud CLI.

    Instala Google Cloud CLI.

    Si usas un proveedor de identidad externo (IdP), primero debes acceder a la gcloud CLI con tu identidad federada.

Para obtener más información, consulta Autentícate para usar REST en la documentación de autenticación de Google Cloud .

Roles obligatorios

Para obtener los permisos que necesitas para crear VMs de forma masiva, pídele a tu administrador que te otorgue el rol de IAM Administrador de instancias de Compute (v1) (roles/compute.instanceAdmin.v1) en el proyecto. Para obtener más información sobre cómo otorgar roles, consulta Administra el acceso a proyectos, carpetas y organizaciones.

Este rol predefinido contiene los permisos necesarios para crear VMs de forma masiva. Para ver los permisos exactos que son necesarios, expande la sección Permisos requeridos:

Permisos necesarios

Se requieren los siguientes permisos para crear VMs de forma masiva:

  • compute.instances.create en el proyecto
  • Si deseas usar una imagen personalizada para crear la VM, sigue estos pasos: compute.images.useReadOnly en la imagen
  • Para usar una instantánea a fin de crear la VM, haz lo siguiente: compute.snapshots.useReadOnly en la instantánea
  • Si quieres usar una plantilla de instancias para crear la VM, sigue estos pasos: compute.instanceTemplates.useReadOnly en la plantilla de instancias
  • A fin de especificar una subred para tu VM: compute.subnetworks.use en el proyecto o en la subred elegida
  • Si deseas especificar una dirección IP estática para la VM: compute.addresses.use en el proyecto
  • Para asignar una dirección IP externa a la VM cuando se usa una red de VPC, compute.subnetworks.useExternalIp en el proyecto o en la subred elegida.
  • Para asignar una red heredada a la VM, ejecuta compute.networks.use en el proyecto.
  • Para asignar una dirección IP externa a la VM cuando se usa una red heredada, ejecuta compute.networks.useExternalIp en el proyecto
  • Para configurar los metadatos de la instancia de VM para la VM, compute.instances.setMetadata en el proyecto.
  • Para configurar etiquetas en la VM, haz lo siguiente: compute.instances.setTags en la VM
  • Para configurar etiquetas en la VM, haz lo siguiente: compute.instances.setLabels en la VM
  • A fin de configurar una cuenta de servicio para que la VM use: compute.instances.setServiceAccount en la VM
  • Crear un disco nuevo para la VM: compute.disks.create en el proyecto
  • Para conectar un disco existente en modo de solo lectura o de lectura y escritura, usa compute.disks.use en el disco.
  • Para conectar un disco existente en modo de solo lectura, haz lo siguiente: compute.disks.useReadOnly en el disco

También puedes obtener estos permisos con roles personalizados o con otros roles predefinidos.

Descripción general

La creación masiva de instancias con el tipo de máquina N1 con GPU T4 o V100 incluye los siguientes pasos:

  1. Crea instancias de forma masiva
  2. Instala controladores de GPU

Crea VMs N1 con GPUs de forma masiva

Para crear VMs de N1 con GPUs de forma masiva, usa uno de los siguientes métodos.

Los siguientes comandos también establecen el permiso de acceso para tus instancias. Para simplificar la administración de permisos, Google recomienda que configures el permiso de acceso en una instancia como acceso cloud-platform y, luego, uses roles de IAM para definir a qué servicios puede acceder la instancia. Para obtener más información, consulta las prácticas recomendadas para los permisos.

gcloud

Para crear instancias de forma masiva, usa el comando gcloud compute instances bulk create.

Los parámetros que debes especificar dependen de la opción de consumo que uses para esta implementación. Selecciona la pestaña que corresponda a tu opción de consumo.

Reserva

Las instancias de N1 con GPU T4 o V100 admiten los siguientes tipos de reservas:

  • Reservas según demanda
  • Reservas futuras estándar

Para consumir estos tipos de reservas, una instancia debe usar el modelo de aprovisionamiento estándar. Por ejemplo, usa los siguientes parámetros de creación.

Antes de ejecutar el comando, revisa todos los pasos que se indican a continuación para determinar si debes incluir marcas adicionales.

gcloud compute instances bulk create \
    --name-pattern=NAME_PATTERN \
    --count=COUNT \
     --machine-type=MACHINE_TYPE \
    --accelerator=type=ACCELERATOR_TYPE,count=ACCELERATOR_COUNT \
    --image-family=IMAGE_FAMILY \
    --image-project=IMAGE_PROJECT \
    --region=REGION \
    --boot-disk-type=DISK_TYPE \
    --boot-disk-size=DISK_SIZE \
    --scopes=cloud-platform \
    --provisioning-model=STANDARD \
    --maintenance-policy=TERMINATE \
    --reservation-affinity=RESERVATION_AFFINITY \
    --reservation=RESERVATION

Completa los siguientes pasos:

  1. Reemplaza lo siguiente:

    • NAME_PATTERN: Es el patrón de nombres que se usará para las instancias de N1 con GPU T4 o V100. Por ejemplo, si usas instance-# para el patrón de nombre, se generan instancias de N1 con GPU T4 o V100 con nombres como instance-1 y instance-2, hasta la cantidad de instancias de N1 con GPU T4 o V100 especificadas por --count.
    • COUNT: Es la cantidad de instancias de N1 con GPUs T4 o V100 que se crearán.
    • MACHINE_TYPE: Es el tipo de máquina que se usará para la instancia de N1 con GPUs T4 o V100. Para obtener más información, consulta Tipos de máquinas con GPU en la documentación de Compute Engine.
    • ACCELERATOR_COUNT: Es la cantidad de GPUs que deseas conectar a tu VM N1. Para obtener una lista de los límites de GPU en función del tipo de máquina de tu VM, consulta la información sobre las GPUs N1 en la documentación de Compute Engine.
    • ACCELERATOR_TYPE: Es el tipo de acelerador para las VMs N1 que deseas usar. Para las cargas de trabajo de IA, te recomendamos que uses GPU T4 o V100.
    • IMAGE_FAMILY: Es la familia de imágenes de la imagen de SO que deseas usar. Para obtener una lista de todos los sistemas operativos compatibles, consulta Sistemas operativos compatibles.
    • IMAGE_PROJECT: Es el ID del proyecto de la imagen de SO.
    • REGION: Especifica una región en la que esté disponible el tipo de máquina que deseas usar. Para obtener información sobre las regiones, consulta Disponibilidad de GPU por regiones y zonas.
    • DISK_TYPE: El tipo de disco de arranque. Para obtener más información sobre los tipos de discos compatibles con tu tipo de máquina, consulta Máquinas con GPU en la familia de máquinas optimizadas para aceleradores en la documentación de Compute Engine.
    • DISK_SIZE: Es el tamaño del disco de arranque en GB. Para obtener más información, consulta Límites de tamaño de Google Cloud Hyperdisk o Límites de tamaño de Persistent Disk, según el tipo de disco.
    • RESERVATION_AFFINITY: Indica qué reservas puede consumir la instancia, si es posible. Especifica una de las siguientes opciones:

      • any (la capacidad de reserva es opcional): Esta es la opción predeterminada. La instancia intenta usar capacidad de una reserva de consumo automático, lo que solo sucede si hay capacidad de reserva coincidente disponible. De lo contrario, la instancia usa capacidad a pedido.

      • specific (Se requiere capacidad de reserva): Requiere que la instancia use capacidad de una reserva orientada específicamente. La instancia no puede usar la capacidad según demanda. Si la capacidad de reserva no está disponible, la creación de la instancia fallará.

    • RESERVATION: Es la reserva que se usará. Especifica una de las siguientes opciones según el valor que especificaste para RESERVATION_AFFINITY:

      • Si especificaste any, reemplaza RESERVATION por una cadena vacía (""). Como alternativa, puedes quitar la marca --reservation por completo.
      • Si especificaste specific, reemplaza RESERVATION por lo siguiente:

        projects/RESERVATION_OWNER_PROJECT_ID/reservations/RESERVATION_NAME

        Reemplaza lo siguiente:

        • RESERVATION_OWNER_PROJECT_ID: Es el ID del proyecto en el que se creó la reserva.
        • RESERVATION_NAME por el nombre de la reserva.
  2. De forma predeterminada, la instancia se reinicia automáticamente si falla o si Compute Engine la detiene por una detención programada, como un evento de mantenimiento. Si quieres inhabilitar el reinicio automático, agrega la siguiente marca:

    --no-restart-on-failure
  3. Opcional: Para conectar discos SSD locales, agrega la siguiente marca --local-ssd para cada disco SSD local.

    Asegúrate de que la cantidad de discos SSD locales que conectes esté permitida para tu tipo de máquina. Para obtener más detalles, consulta Acerca de los discos SSD locales en la documentación de Compute Engine.

    --local-ssd interface=INTERFACE_TYPE
    

    Reemplaza lo siguiente:

    • INTERFACE_TYPE: Es el tipo de interfaz de disco que deseas usar para el disco SSD local. Si tu imagen de disco de arranque tiene controladores NVMe optimizados, especifica NVME. Especifica SCSI para otras imágenes.

    Después de crear una VM con discos SSD locales, debes formatear y activar cada dispositivo antes de poder usarlo.

  4. Ejecute el comando.

A pedido

Antes de ejecutar el comando, revisa todos los pasos que se indican a continuación para determinar si debes incluir marcas adicionales.

gcloud compute instances bulk create \
    --name-pattern=NAME_PATTERN \
    --count=COUNT \
     --machine-type=MACHINE_TYPE \
    --accelerator=type=ACCELERATOR_TYPE,count=ACCELERATOR_COUNT \
    --image-family=IMAGE_FAMILY \
    --image-project=IMAGE_PROJECT \
    --region=REGION \
    --boot-disk-type=DISK_TYPE \
    --boot-disk-size=DISK_SIZE \
    --scopes=cloud-platform \
    --provisioning-model=STANDARD \
    --maintenance-policy=TERMINATE \
    --reservation-affinity=RESERVATION_AFFINITY

Completa los siguientes pasos:

  1. Reemplaza lo siguiente:

    • NAME_PATTERN: Es el patrón de nombres que se usará para las instancias de N1 con GPU T4 o V100. Por ejemplo, si usas instance-# para el patrón de nombre, se generan instancias de N1 con GPU T4 o V100 con nombres como instance-1 y instance-2, hasta la cantidad de instancias de N1 con GPU T4 o V100 especificadas por --count.
    • COUNT: Es la cantidad de instancias de N1 con GPUs T4 o V100 que se crearán.
    • MACHINE_TYPE: Es el tipo de máquina que se usará para la instancia de N1 con GPUs T4 o V100. Para obtener más información, consulta Tipos de máquinas con GPU en la documentación de Compute Engine.
    • ACCELERATOR_COUNT: Es la cantidad de GPUs que deseas conectar a tu VM N1. Para obtener una lista de los límites de GPU en función del tipo de máquina de tu VM, consulta la información sobre las GPUs N1 en la documentación de Compute Engine.
    • ACCELERATOR_TYPE: Es el tipo de acelerador para las VMs N1 que deseas usar. Para las cargas de trabajo de IA, te recomendamos que uses GPU T4 o V100.
    • IMAGE_FAMILY: Es la familia de imágenes de la imagen de SO que deseas usar. Para obtener una lista de todos los sistemas operativos compatibles, consulta Sistemas operativos compatibles.
    • IMAGE_PROJECT: Es el ID del proyecto de la imagen de SO.
    • REGION: Especifica una región en la que esté disponible el tipo de máquina que deseas usar. Para obtener información sobre las regiones, consulta Disponibilidad de GPU por regiones y zonas.
    • DISK_TYPE: El tipo de disco de arranque. Para obtener más información sobre los tipos de discos compatibles con tu tipo de máquina, consulta Máquinas con GPU en la familia de máquinas optimizadas para aceleradores en la documentación de Compute Engine.
    • DISK_SIZE: Es el tamaño del disco de arranque en GB. Para obtener más información, consulta Límites de tamaño de Google Cloud Hyperdisk o Límites de tamaño de Persistent Disk, según el tipo de disco.
    • RESERVATION_AFFINITY: Indica qué reservas puede consumir la instancia, si es posible. Especifica una de las siguientes opciones:

      • any (la capacidad de reserva es opcional): Esta es la opción predeterminada. La instancia intenta usar capacidad de una reserva de consumo automático, lo que solo sucede si hay capacidad de reserva coincidente disponible. De lo contrario, la instancia usa capacidad a pedido.

      • none (Se requiere capacidad según demanda): Bloquea la instancia para que no use ninguna capacidad de reserva.

  2. De forma predeterminada, la instancia se reinicia automáticamente si falla o si Compute Engine la detiene por una detención programada, como un evento de mantenimiento. Si quieres inhabilitar el reinicio automático, agrega la siguiente marca:

    --no-restart-on-failure
  3. Opcional: Para conectar discos SSD locales, agrega la siguiente marca --local-ssd para cada disco SSD local.

    Asegúrate de que la cantidad de discos SSD locales que conectes esté permitida para tu tipo de máquina. Para obtener más detalles, consulta Acerca de los discos SSD locales en la documentación de Compute Engine.

    --local-ssd interface=INTERFACE_TYPE
    

    Reemplaza lo siguiente:

    • INTERFACE_TYPE: Es el tipo de interfaz de disco que deseas usar para el disco SSD local. Si tu imagen de disco de arranque tiene controladores NVMe optimizados, especifica NVME. Especifica SCSI para otras imágenes.

    Después de crear una VM con discos SSD locales, debes formatear y activar cada dispositivo antes de poder usarlo.

  4. Ejecute el comando.

Spot

Antes de ejecutar el comando, revisa todos los pasos que se indican a continuación para determinar si debes incluir marcas adicionales.

gcloud compute instances bulk create \
    --name-pattern=NAME_PATTERN \
    --count=COUNT \
     --machine-type=MACHINE_TYPE \
    --accelerator=type=ACCELERATOR_TYPE,count=ACCELERATOR_COUNT \
    --image-family=IMAGE_FAMILY \
    --image-project=IMAGE_PROJECT \
    --region=REGION \
    --boot-disk-type=DISK_TYPE \
    --boot-disk-size=DISK_SIZE \
    --scopes=cloud-platform \
    --provisioning-model=SPOT \
    --instance-termination-action=TERMINATION_ACTION \
    --maintenance-policy=TERMINATE \
    --no-restart-on-failure

Completa los siguientes pasos:

  1. Reemplaza lo siguiente:

    • NAME_PATTERN: Es el patrón de nombres que se usará para las instancias de N1 con GPU T4 o V100. Por ejemplo, si usas instance-# para el patrón de nombre, se generan instancias de N1 con GPU T4 o V100 con nombres como instance-1 y instance-2, hasta la cantidad de instancias de N1 con GPU T4 o V100 especificadas por --count.
    • COUNT: Es la cantidad de instancias de N1 con GPUs T4 o V100 que se crearán.
    • MACHINE_TYPE: Es el tipo de máquina que se usará para la instancia de N1 con GPUs T4 o V100. Para obtener más información, consulta Tipos de máquinas con GPU en la documentación de Compute Engine.
    • ACCELERATOR_COUNT: Es la cantidad de GPUs que deseas conectar a tu VM N1. Para obtener una lista de los límites de GPU en función del tipo de máquina de tu VM, consulta la información sobre las GPUs N1 en la documentación de Compute Engine.
    • ACCELERATOR_TYPE: Es el tipo de acelerador para las VMs N1 que deseas usar. Para las cargas de trabajo de IA, te recomendamos que uses GPU T4 o V100.
    • IMAGE_FAMILY: Es la familia de imágenes de la imagen de SO que deseas usar. Para obtener una lista de todos los sistemas operativos compatibles, consulta Sistemas operativos compatibles.
    • IMAGE_PROJECT: Es el ID del proyecto de la imagen de SO.
    • REGION: Especifica una región en la que esté disponible el tipo de máquina que deseas usar. Para obtener información sobre las regiones, consulta Disponibilidad de GPU por regiones y zonas.
    • DISK_TYPE: El tipo de disco de arranque. Para obtener más información sobre los tipos de discos compatibles con tu tipo de máquina, consulta Máquinas con GPU en la familia de máquinas optimizadas para aceleradores en la documentación de Compute Engine.
    • DISK_SIZE: Es el tamaño del disco de arranque en GB. Para obtener más información, consulta Límites de tamaño de Google Cloud Hyperdisk o Límites de tamaño de Persistent Disk, según el tipo de disco.
    • TERMINATION_ACTION: Es la acción que se debe realizar cuando Compute Engine interrumpe la instancia, ya sea STOP (predeterminada) o DELETE.

  2. Opcional: Para conectar discos SSD locales, agrega la siguiente marca --local-ssd para cada disco SSD local.

    Asegúrate de que la cantidad de discos SSD locales que conectes esté permitida para tu tipo de máquina. Para obtener más detalles, consulta Acerca de los discos SSD locales en la documentación de Compute Engine.

    --local-ssd interface=INTERFACE_TYPE
    

    Reemplaza lo siguiente:

    • INTERFACE_TYPE: Es el tipo de interfaz de disco que deseas usar para el disco SSD local. Si tu imagen de disco de arranque tiene controladores NVMe optimizados, especifica NVME. Especifica SCSI para otras imágenes.

    Después de crear una VM con discos SSD locales, debes formatear y activar cada dispositivo antes de poder usarlo.

  3. Ejecute el comando.

REST

Para crear instancias de forma masiva, realiza una solicitud POST al método instances.bulkInsert.

Los parámetros que debes especificar dependen de la opción de consumo que uses para esta implementación. Selecciona la pestaña que corresponda a tu opción de consumo.

Reserva

Las instancias de N1 con GPU T4 o V100 admiten los siguientes tipos de reservas:

  • Reservas según demanda
  • Reservas futuras estándar

Para consumir estos tipos de reservas, una instancia debe usar el modelo de aprovisionamiento estándar. Por ejemplo, usa los siguientes parámetros de creación.

Antes de enviar la solicitud, revisa todos los pasos que se indican a continuación para determinar si debes incluir campos adicionales.

POST https://compute.googleapis.com/compute/v1/projects/PROJECT_ID/zones/ZONE/instances/bulkInsert
{
  "namePattern": "NAME_PATTERN",
  "count": "COUNT",
  "instanceProperties": {
    "machineType": "MACHINE_TYPE",
    "guestAccelerators":
    [
      {
        "acceleratorCount": ACCELERATOR_COUNT,
        "acceleratorType": "projects/PROJECT_ID/zones/ZONE/acceleratorTypes/ACCELERATOR_TYPE"
      }
    ],
    "disks": [
      {
        "boot": true,
        "initializeParams": {
          "diskSizeGb": "DISK_SIZE",
          "diskType": "DISK_TYPE",
          "sourceImage": "projects/IMAGE_PROJECT/global/images/family/IMAGE_FAMILY"
        },
        "mode": "READ_WRITE",
        "type": "PERSISTENT"
      }
    ],
    "serviceAccounts": [
      {
        "email": "default",
        "scopes": [
          "https://www.googleapis.com/auth/cloud-platform"
        ]
      }
    ],
    "scheduling": {
    "provisioningModel": "STANDARD",
    "onHostMaintenance": "TERMINATE",
    "automaticRestart": AUTOMATIC_RESTART
  },
  "reservationAffinity": {
    "consumeReservationType": "RESERVATION_AFFINITY",
    "key": "compute.googleapis.com/reservation-name",
    "values": [
      "RESERVATION"
    ]
  }
  }
}

Completa los siguientes pasos:

  1. Reemplaza lo siguiente:

    • PROJECT_ID: Es el ID del proyecto en el que deseas crear la instancia N1 con GPUs T4 o V100.
    • ZONE: Especifica una zona en la que esté disponible el tipo de máquina que deseas usar. Para obtener información sobre las regiones, consulta Disponibilidad de GPU por regiones y zonas.
    • NAME_PATTERN: Es el patrón de nombres que se usará para las instancias de N1 con GPU T4 o V100. Por ejemplo, si usas instance-# para el patrón de nombre, se generan instancias de N1 con GPU T4 o V100 con nombres como instance-1 y instance-2, hasta la cantidad de instancias de N1 con GPU T4 o V100 especificadas por --count.
    • COUNT: Es la cantidad de instancias de N1 con GPUs T4 o V100 que se crearán.
    • MACHINE_TYPE: Es el tipo de máquina que se usará para la instancia de N1 con GPUs T4 o V100. Para obtener más información, consulta Tipos de máquinas con GPU en la documentación de Compute Engine.
    • ACCELERATOR_COUNT: Es la cantidad de GPUs que deseas conectar a tu VM N1. Para obtener una lista de los límites de GPU en función del tipo de máquina de tu VM, consulta la información sobre las GPUs N1 en la documentación de Compute Engine.
    • ACCELERATOR_TYPE: Es el tipo de acelerador para las VMs N1 que deseas usar. Para las cargas de trabajo de IA, te recomendamos que uses GPU T4 o V100.
    • DISK_SIZE: Es el tamaño del disco de arranque en GB. Para obtener más información, consulta Límites de tamaño de Google Cloud Hyperdisk o Límites de tamaño de Persistent Disk, según el tipo de disco.
    • DISK_TYPE: El tipo de disco de arranque. Para obtener más información sobre los tipos de discos compatibles con tu tipo de máquina, consulta Máquinas con GPU en la familia de máquinas optimizadas para aceleradores en la documentación de Compute Engine.
    • IMAGE_PROJECT: Es el ID del proyecto de la imagen de SO.
    • IMAGE_FAMILY: Es la familia de imágenes de la imagen de SO que deseas usar. Para obtener una lista de todos los sistemas operativos compatibles, consulta Sistemas operativos compatibles.
    • AUTOMATIC_RESTART: Indica si la instancia se reinicia automáticamente si falla o si Compute Engine la detiene por una detención programada, como un evento de mantenimiento. Especifica true para habilitar el reinicio automático (predeterminado) o false para inhabilitarlo.

    • RESERVATION_AFFINITY: Indica qué reservas puede consumir la instancia, si es posible. Especifica una de las siguientes opciones:

      • ANY_RESERVATION (la capacidad de reserva es opcional): Esta es la opción predeterminada. La instancia intenta usar capacidad de una reserva que se consume automáticamente, lo que solo sucede si hay capacidad de reserva coincidente disponible. De lo contrario, la instancia usa capacidad a pedido.

      • SPECIFIC_RESERVATION (Se requiere capacidad de reserva): Requiere que la instancia use capacidad de una reserva orientada específicamente. La instancia no puede usar la capacidad según demanda. Si la capacidad de reserva no está disponible, la creación de la instancia fallará.

    • RESERVATION: Es la reserva que se usará. Especifica una de las siguientes opciones según el valor que especificaste para RESERVATION_AFFINITY:

      • Si especificaste ANY_RESERVATION, borra RESERVATION para que el valor sea una cadena vacía (""). Como alternativa, puedes quitar por completo los campos key y values.
      • Si especificaste SPECIFIC_RESERVATION, reemplaza RESERVATION por lo siguiente:

        projects/RESERVATION_OWNER_PROJECT_ID/reservations/RESERVATION_NAME

        Reemplaza lo siguiente:

        • RESERVATION_OWNER_PROJECT_ID: Es el ID del proyecto en el que se creó la reserva.
        • RESERVATION_NAME por el nombre de la reserva.
  2. Opcional: Para usar discos SSD locales, agrega el siguiente campo al campo disks[] para cada disco SSD local. Separa cada subcampo disks[] (incluido el disco de arranque) con una coma.

    Asegúrate de que la cantidad de discos SSD locales que conectes esté permitida para tu tipo de máquina. Para obtener más detalles, consulta Acerca de los discos SSD locales en la documentación de Compute Engine.

        {
           "type": "SCRATCH",
           "initializeParams": {
              "diskType": "zones/ZONE/diskTypes/local-ssd"
           },
           "autoDelete": true,
           "interface": "INTERFACE_TYPE"
        }
    

    Reemplaza lo siguiente:

    • ZONE: La zona que especificaste.
    • INTERFACE_TYPE: Es el tipo de interfaz de disco que deseas usar para el disco SSD local. Si tu imagen de disco de arranque tiene controladores NVMe optimizados, especifica NVME. Especifica SCSI para otras imágenes.

    Después de crear una VM con discos SSD locales, debes formatear y activar cada dispositivo antes de poder usarlo.

  3. Envía la solicitud.

A pedido

Antes de enviar la solicitud, revisa todos los pasos que se indican a continuación para determinar si debes incluir campos adicionales.

POST https://compute.googleapis.com/compute/v1/projects/PROJECT_ID/zones/ZONE/instances/bulkInsert
{
  "namePattern": "NAME_PATTERN",
  "count": "COUNT",
  "instanceProperties": {
    "machineType": "MACHINE_TYPE",
    "guestAccelerators":
    [
      {
        "acceleratorCount": ACCELERATOR_COUNT,
        "acceleratorType": "projects/PROJECT_ID/zones/ZONE/acceleratorTypes/ACCELERATOR_TYPE"
      }
    ],
    "disks": [
      {
        "boot": true,
        "initializeParams": {
          "diskSizeGb": "DISK_SIZE",
          "diskType": "DISK_TYPE",
          "sourceImage": "projects/IMAGE_PROJECT/global/images/family/IMAGE_FAMILY"
        },
        "mode": "READ_WRITE",
        "type": "PERSISTENT"
      }
    ],
    "serviceAccounts": [
      {
        "email": "default",
        "scopes": [
          "https://www.googleapis.com/auth/cloud-platform"
        ]
      }
    ],
    "scheduling": {
    "provisioningModel": "STANDARD",
    "onHostMaintenance": "TERMINATE",
    "automaticRestart": AUTOMATIC_RESTART
  },
  "reservationAffinity": {
    "consumeReservationType": "RESERVATION_AFFINITY"
  }
  }
}

Completa los siguientes pasos:

  1. Reemplaza lo siguiente:

    • PROJECT_ID: Es el ID del proyecto en el que deseas crear la instancia N1 con GPUs T4 o V100.
    • ZONE: Especifica una zona en la que esté disponible el tipo de máquina que deseas usar. Para obtener información sobre las regiones, consulta Disponibilidad de GPU por regiones y zonas.
    • NAME_PATTERN: Es el patrón de nombres que se usará para las instancias de N1 con GPU T4 o V100. Por ejemplo, si usas instance-# para el patrón de nombre, se generan instancias de N1 con GPU T4 o V100 con nombres como instance-1 y instance-2, hasta la cantidad de instancias de N1 con GPU T4 o V100 especificadas por --count.
    • COUNT: Es la cantidad de instancias de N1 con GPUs T4 o V100 que se crearán.
    • MACHINE_TYPE: Es el tipo de máquina que se usará para la instancia de N1 con GPUs T4 o V100. Para obtener más información, consulta Tipos de máquinas con GPU en la documentación de Compute Engine.
    • ACCELERATOR_COUNT: Es la cantidad de GPUs que deseas conectar a tu VM N1. Para obtener una lista de los límites de GPU en función del tipo de máquina de tu VM, consulta la información sobre las GPUs N1 en la documentación de Compute Engine.
    • ACCELERATOR_TYPE: Es el tipo de acelerador para las VMs N1 que deseas usar. Para las cargas de trabajo de IA, te recomendamos que uses GPU T4 o V100.
    • DISK_SIZE: Es el tamaño del disco de arranque en GB. Para obtener más información, consulta Límites de tamaño de Google Cloud Hyperdisk o Límites de tamaño de Persistent Disk, según el tipo de disco.
    • DISK_TYPE: El tipo de disco de arranque. Para obtener más información sobre los tipos de discos compatibles con tu tipo de máquina, consulta Máquinas con GPU en la familia de máquinas optimizadas para aceleradores en la documentación de Compute Engine.
    • IMAGE_PROJECT: Es el ID del proyecto de la imagen de SO.
    • IMAGE_FAMILY: Es la familia de imágenes de la imagen de SO que deseas usar. Para obtener una lista de todos los sistemas operativos compatibles, consulta Sistemas operativos compatibles.
    • AUTOMATIC_RESTART: Indica si la instancia se reinicia automáticamente si falla o si Compute Engine la detiene por una detención programada, como un evento de mantenimiento. Especifica true para habilitar el reinicio automático (predeterminado) o false para inhabilitarlo.

    • RESERVATION_AFFINITY: Indica qué reservas puede consumir la instancia, si es posible. Especifica una de las siguientes opciones:

      • ANY_RESERVATION (la capacidad de reserva es opcional): Esta es la opción predeterminada. La instancia intenta usar capacidad de una reserva que se consume automáticamente, lo que solo sucede si hay capacidad de reserva coincidente disponible. De lo contrario, la instancia usa capacidad a pedido.

      • NO_RESERVATION (Se requiere capacidad según demanda): Bloquea la instancia para que no use ninguna capacidad de reserva.

  2. Opcional: Para usar discos SSD locales, agrega el siguiente campo al campo disks[] para cada disco SSD local. Separa cada subcampo disks[] (incluido el disco de arranque) con una coma.

    Asegúrate de que la cantidad de discos SSD locales que conectes esté permitida para tu tipo de máquina. Para obtener más detalles, consulta Acerca de los discos SSD locales en la documentación de Compute Engine.

        {
           "type": "SCRATCH",
           "initializeParams": {
              "diskType": "zones/ZONE/diskTypes/local-ssd"
           },
           "autoDelete": true,
           "interface": "INTERFACE_TYPE"
        }
    

    Reemplaza lo siguiente:

    • ZONE: La zona que especificaste.
    • INTERFACE_TYPE: Es el tipo de interfaz de disco que deseas usar para el disco SSD local. Si tu imagen de disco de arranque tiene controladores NVMe optimizados, especifica NVME. Especifica SCSI para otras imágenes.

    Después de crear una VM con discos SSD locales, debes formatear y activar cada dispositivo antes de poder usarlo.

  3. Envía la solicitud.

Spot

Antes de enviar la solicitud, revisa todos los pasos que se indican a continuación para determinar si debes incluir campos adicionales.

POST https://compute.googleapis.com/compute/v1/projects/PROJECT_ID/zones/ZONE/instances/bulkInsert
{
  "namePattern": "NAME_PATTERN",
  "count": "COUNT",
  "instanceProperties": {
    "machineType": "MACHINE_TYPE",
    "guestAccelerators":
    [
      {
        "acceleratorCount": ACCELERATOR_COUNT,
        "acceleratorType": "projects/PROJECT_ID/zones/ZONE/acceleratorTypes/ACCELERATOR_TYPE"
      }
    ],
    "disks": [
      {
        "boot": true,
        "initializeParams": {
          "diskSizeGb": "DISK_SIZE",
          "diskType": "DISK_TYPE",
          "sourceImage": "projects/IMAGE_PROJECT/global/images/family/IMAGE_FAMILY"
        },
        "mode": "READ_WRITE",
        "type": "PERSISTENT"
      }
    ],
    "serviceAccounts": [
      {
        "email": "default",
        "scopes": [
          "https://www.googleapis.com/auth/cloud-platform"
        ]
      }
    ],
    "scheduling":
    {
      "provisioningModel": "SPOT",
      "instanceTerminationAction": "TERMINATION_ACTION",
      "onHostMaintenance": "TERMINATE",
      "automaticRestart": false
    }
  }
}

Completa los siguientes pasos:

  1. Reemplaza lo siguiente:

    • PROJECT_ID: Es el ID del proyecto en el que deseas crear la instancia N1 con GPUs T4 o V100.
    • ZONE: Especifica una zona en la que esté disponible el tipo de máquina que deseas usar. Para obtener información sobre las regiones, consulta Disponibilidad de GPU por regiones y zonas.
    • NAME_PATTERN: Es el patrón de nombres que se usará para las instancias de N1 con GPU T4 o V100. Por ejemplo, si usas instance-# para el patrón de nombre, se generan instancias de N1 con GPU T4 o V100 con nombres como instance-1 y instance-2, hasta la cantidad de instancias de N1 con GPU T4 o V100 especificadas por --count.
    • COUNT: Es la cantidad de instancias de N1 con GPUs T4 o V100 que se crearán.
    • MACHINE_TYPE: Es el tipo de máquina que se usará para la instancia de N1 con GPUs T4 o V100. Para obtener más información, consulta Tipos de máquinas con GPU en la documentación de Compute Engine.
    • ACCELERATOR_COUNT: Es la cantidad de GPUs que deseas conectar a tu VM N1. Para obtener una lista de los límites de GPU en función del tipo de máquina de tu VM, consulta la información sobre las GPUs N1 en la documentación de Compute Engine.
    • ACCELERATOR_TYPE: Es el tipo de acelerador para las VMs N1 que deseas usar. Para las cargas de trabajo de IA, te recomendamos que uses GPU T4 o V100.
    • DISK_SIZE: Es el tamaño del disco de arranque en GB. Para obtener más información, consulta Límites de tamaño de Google Cloud Hyperdisk o Límites de tamaño de Persistent Disk, según el tipo de disco.
    • DISK_TYPE: El tipo de disco de arranque. Para obtener más información sobre los tipos de discos compatibles con tu tipo de máquina, consulta Máquinas con GPU en la familia de máquinas optimizadas para aceleradores en la documentación de Compute Engine.
    • IMAGE_PROJECT: Es el ID del proyecto de la imagen de SO.
    • IMAGE_FAMILY: Es la familia de imágenes de la imagen de SO que deseas usar. Para obtener una lista de todos los sistemas operativos compatibles, consulta Sistemas operativos compatibles.
    • TERMINATION_ACTION: Es la acción que se debe realizar cuando Compute Engine interrumpe la instancia, ya sea STOP (predeterminada) o DELETE.

  2. Opcional: Para usar discos SSD locales, agrega el siguiente campo al campo disks[] para cada disco SSD local. Separa cada subcampo disks[] (incluido el disco de arranque) con una coma.

    Asegúrate de que la cantidad de discos SSD locales que conectes esté permitida para tu tipo de máquina. Para obtener más detalles, consulta Acerca de los discos SSD locales en la documentación de Compute Engine.

        {
           "type": "SCRATCH",
           "initializeParams": {
              "diskType": "zones/ZONE/diskTypes/local-ssd"
           },
           "autoDelete": true,
           "interface": "INTERFACE_TYPE"
        }
    

    Reemplaza lo siguiente:

    • ZONE: La zona que especificaste.
    • INTERFACE_TYPE: Es el tipo de interfaz de disco que deseas usar para el disco SSD local. Si tu imagen de disco de arranque tiene controladores NVMe optimizados, especifica NVME. Especifica SCSI para otras imágenes.

    Después de crear una VM con discos SSD locales, debes formatear y activar cada dispositivo antes de poder usarlo.

  3. Envía la solicitud.

Para obtener más información sobre las opciones de configuración cuando creas VMs de forma masiva, consulta Crea VMs de forma masiva en la documentación de Compute Engine.

Instalar los controladores de GPU.

Después de crear una instancia, esta no puede usar sus GPUs a menos que ya estén instalados los controladores de GPU correctos. El controlador que debes instalar depende de si la instancia habilitó la estación de trabajo virtual (vWS) NVIDIA RTX. Usa una de las siguientes opciones:

¿Qué sigue?