Crea una instancia de G2 optimizada para IA

En este documento, se describen los pasos para crear instancias de máquina virtual (VM) independientes que usan la serie de máquinas G2. Para obtener más información sobre estos tipos de máquinas optimizados para aceleradores, consulta la serie G2.

Para obtener información sobre otras formas de crear VMs o clústeres, consulta la Descripción general de las opciones de implementación.

Limitaciones

Cuando creas una VM independiente de G2, se aplican las siguientes limitaciones:

  • No recibirás descuentos por uso continuo ni descuentos por compromiso de uso flexible para las instancias que usan un tipo de máquina G2.
  • Solo puedes usar un tipo de máquina G2 en ciertas regiones y zonas.
  • Los tipos de máquinas G2 solo están disponibles en la plataforma Cascade Lake.
  • El disco persistente estándar (pd-standard) no es compatible con las instancias que usan el tipo de máquina G2. Para conocer los tipos de discos compatibles, consulta Tipos de discos compatibles con G2.
  • No puedes crear GPUs de instancias múltiples en una instancia que usa un tipo de máquina G2.
  • Si necesitas cambiar el tipo de máquina de una instancia G2, revisa Modifica las instancias optimizadas para aceleradores.
  • No puedes usar imágenes de Deep Learning VM Image como discos de arranque para las instancias que usan el tipo de máquina G2.
  • El controlador predeterminado actual para Container-Optimized OS no es compatible con las GPU L4 que se ejecutan en los tipos de máquinas G2. Además, Container-Optimized OS solo admite un conjunto selecto de controladores. Si deseas usar Container-Optimized OS en tipos de máquinas G2, revisa las siguientes notas:
    • Usa una versión de Container-Optimized OS que sea compatible con la versión mínima recomendada del controlador NVIDIA 525.60.13 o posterior. Para obtener más información, revisa las notas de la versión de Container-Optimized OS.
    • Cuando instalas el controlador, especifica la versión más reciente disponible que funcione para las GPU L4. Por ejemplo, sudo cos-extensions install gpu -- -version=525.60.13
  • Debes usar Google Cloud CLI o REST para crear instancias de G2 en las siguientes situaciones:
    • Deseas especificar valores de memoria personalizados.
    • Deseas personalizar la cantidad de núcleos de CPU visibles.
Si deseas usar una política de posición compacta, revisa las restricciones para las políticas de posición.

Antes de comenzar

Antes de crear VMs, si aún no lo hiciste, completa los siguientes pasos:

  1. Elige una opción de consumo: La opción de consumo que elijas determinará cómo obtendrás y usarás los recursos de GPU. Para obtener más información, consulta Elige una opción de consumo.
  2. Obtén capacidad: El proceso para obtener capacidad difiere para cada opción de consumo. Para obtener información sobre el proceso para obtener capacidad para la opción de consumo que elegiste, consulta Descripción general de la capacidad.

Selecciona la pestaña que corresponda a la forma en que planeas usar las muestras de esta página:

Console

Cuando usas la consola de Google Cloud para acceder a los servicios y las APIs de Google Cloud , no necesitas configurar la autenticación.

gcloud

En la consola de Google Cloud , activa Cloud Shell.

Activa Cloud Shell

En la parte inferior de la consola de Google Cloud , se inicia una sesión de Cloud Shell en la que se muestra una ventana de línea de comandos. Cloud Shell es un entorno de shell con Google Cloud CLI ya instalada y con valores ya establecidos para el proyecto actual. La sesión puede tardar unos segundos en inicializarse.

REST

Para usar las muestras de la API de REST incluidas en esta página en un entorno de desarrollo local, debes usar las credenciales que proporciones a la gcloud CLI.

    Instala Google Cloud CLI.

    Si usas un proveedor de identidad externo (IdP), primero debes acceder a la gcloud CLI con tu identidad federada.

Para obtener más información, consulta Autentícate para usar REST en la documentación de autenticación de Google Cloud .

Roles obligatorios

Para obtener los permisos que necesitas para crear VMs, pídele a tu administrador que te otorgue el rol de IAM Administrador de instancias de Compute (v1) (roles/compute.instanceAdmin.v1) en el proyecto. Para obtener más información sobre cómo otorgar roles, consulta Administra el acceso a proyectos, carpetas y organizaciones.

Este rol predefinido contiene los permisos necesarios para crear VM. Para ver los permisos exactos que son necesarios, expande la sección Permisos requeridos:

Permisos necesarios

Se requieren los siguientes permisos para crear VM:

  • compute.instances.create en el proyecto
  • Si deseas usar una imagen personalizada para crear la VM, sigue estos pasos: compute.images.useReadOnly en la imagen
  • Para usar una instantánea a fin de crear la VM, haz lo siguiente: compute.snapshots.useReadOnly en la instantánea
  • Si quieres usar una plantilla de instancias para crear la VM, sigue estos pasos: compute.instanceTemplates.useReadOnly en la plantilla de instancias
  • A fin de especificar una subred para tu VM: compute.subnetworks.use en el proyecto o en la subred elegida
  • Si deseas especificar una dirección IP estática para la VM: compute.addresses.use en el proyecto
  • Para asignar una dirección IP externa a la VM cuando se usa una red de VPC, compute.subnetworks.useExternalIp en el proyecto o en la subred elegida.
  • Para asignar una red heredada a la VM, ejecuta compute.networks.use en el proyecto.
  • Para asignar una dirección IP externa a la VM cuando se usa una red heredada, ejecuta compute.networks.useExternalIp en el proyecto
  • Para configurar los metadatos de la instancia de VM para la VM, compute.instances.setMetadata en el proyecto.
  • Para configurar etiquetas en la VM, haz lo siguiente: compute.instances.setTags en la VM
  • Para configurar etiquetas en la VM, haz lo siguiente: compute.instances.setLabels en la VM
  • A fin de configurar una cuenta de servicio para que la VM use: compute.instances.setServiceAccount en la VM
  • Crear un disco nuevo para la VM: compute.disks.create en el proyecto
  • Para conectar un disco existente en modo de solo lectura o de lectura y escritura, usa compute.disks.use en el disco.
  • Para conectar un disco existente en modo de solo lectura, haz lo siguiente: compute.disks.useReadOnly en el disco

También puedes obtener estos permisos con roles personalizados o con otros roles predefinidos.

Descripción general

La creación de una instancia con el tipo de máquina G2 incluye los siguientes pasos:

  1. Opcional: Crea una política de posición compacta
  2. Crea una instancia
  3. Instala controladores de GPU

Opcional: Crea una política de posición compacta

Puedes especificar la posición de la VM creando una política de posición compacta. Cuando aplicas una política de posición compacta a tus VMs, Compute Engine hace su mejor esfuerzo para crear VMs que estén lo más cerca posible entre sí. Si tu aplicación es sensible a la latencia y requiere la máxima compactación, especifica el campo maxDistance (versión preliminar) cuando crees una política de posición compacta. Un valor de maxDistance más bajo garantiza una colocación más cercana de las VM, pero también aumenta la probabilidad de que no se creen algunas VMs.

Para crear una política de posición compacta, selecciona una de las siguientes opciones:

gcloud

Para crear una política de posición compacta, usa el comando gcloud beta compute resource-policies create group-placement:

gcloud beta compute resource-policies create group-placement POLICY_NAME \
    --collocation=collocated \
    --max-distance=MAX_DISTANCE \
    --region=REGION

Reemplaza lo siguiente:

  • POLICY_NAME: el nombre de la política de posición compacta.
  • MAX_DISTANCE: Es la configuración de distancia máxima para tus VMs, que se puede especificar (vista previa, recomendado) o no especificar (quita la marca --max-distance). Según lo que admita tu tipo de máquina, puedes especificar uno de los siguientes valores:
    • Para colocar las VMs en el mismo subbloque, haz lo siguiente: 1
    • Para colocar las VMs en el mismo bloque, haz lo siguiente: 2
    • Para colocar VMs en bloques adyacentes: 3
    Asegúrate de que la configuración de distancia máxima admita la serie de máquinas y la cantidad de VMs que planeas crear. Para obtener más información, consulta Acerca de las políticas de posición compacta en la documentación de Compute Engine.
  • REGION: la región en la que deseas crear la política de posición compacta. Especifica la región que contiene la zona en la que planeas crear instancias y verifica que el tipo de máquina que deseas usar esté disponible en esa región. Para obtener información sobre las regiones, consulta Disponibilidad de GPU por regiones y zonas.

REST

Para crear una política de posición compacta, realiza una solicitud POST al método resourcePolicies.insert de la versión beta. En el cuerpo de la solicitud, incluye el campo collocation configurado como COLLOCATED y el campo maxDistance.

POST https://compute.googleapis.com/compute/beta/projects/PROJECT_ID/regions/REGION/resourcePolicies
  {
    "name": "POLICY_NAME",
    "groupPlacementPolicy": {
      "collocation": "COLLOCATED",
      "maxDistance": MAX_DISTANCE
    }
  }

Reemplaza lo siguiente:

  • PROJECT_ID: el ID de tu proyecto
  • POLICY_NAME: el nombre de la política de posición compacta.
  • MAX_DISTANCE: Es la configuración de distancia máxima para tus VMs, que se puede especificar (vista previa, recomendada) o no especificar (quitar el campo maxDistance). Según lo que admita tu tipo de máquina, puedes especificar uno de los siguientes valores:
    • Para colocar las VMs en el mismo subbloque, haz lo siguiente: 1
    • Para colocar las VMs en el mismo bloque, haz lo siguiente: 2
    • Para colocar VMs en bloques adyacentes: 3
    Asegúrate de que la configuración de distancia máxima admita la serie de máquinas y la cantidad de VMs que planeas crear. Para obtener más información, consulta Acerca de las políticas de posición compacta en la documentación de Compute Engine.
  • REGION: la región en la que deseas crear la política de posición compacta. Especifica la región que contiene la zona en la que planeas crear instancias y verifica que el tipo de máquina que deseas usar esté disponible en esa región. Para obtener información sobre las regiones, consulta Disponibilidad de GPU por regiones y zonas.

Crea una VM de G2

Para crear una VM de G2, usa uno de los siguientes métodos.

Los siguientes comandos también establecen el permiso de acceso para tus instancias. Para simplificar la administración de permisos, Google recomienda que configures el permiso de acceso en una instancia como acceso cloud-platform y, luego, uses roles de IAM para definir a qué servicios puede acceder la instancia. Para obtener más información, consulta las prácticas recomendadas para los permisos.

Console

  1. En la consola de Google Cloud , ve a la página Crear una instancia.

    Ir a Crear una instancia

  2. Especifica un Nombre para la VM. Consulta la convención de asignación de nombres de recursos.

  3. Selecciona la región y la zona en las que deseas crear una VM. Consulta la lista de regiones y zonas de GPU disponibles.

  4. Haz clic en la pestaña GPUs y, luego, completa los siguientes pasos:

    1. Para usar la serie de máquinas G2, en la lista Tipo de GPU, selecciona NVIDIA L4.
    2. En la lista Cantidad de GPU, selecciona una cantidad.
    3. En la sección Tipo de máquina, selecciona un tipo de máquina.
  5. Según la opción de consumo que quieras usar, selecciona una de las siguientes opciones y completa los pasos que se indican a continuación.

    Reserva

    Las instancias de G2 admiten los siguientes tipos de reservas:

    • Reservas según demanda
    • Reservas futuras estándar

    Para consumir estos tipos de reservas, una instancia debe usar el modelo de aprovisionamiento estándar. Por ejemplo, usa los siguientes parámetros de creación.

    1. En la sección Modelo de aprovisionamiento, en la lista Modelo de aprovisionamiento de VM, selecciona Estándar. (Esta opción está seleccionada de forma predeterminada).
    2. Para configurar qué reservas usa esta VM, completa los siguientes pasos:

      1. En el menú de navegación, haz clic en Opciones avanzadas.
      2. En Reservations, selecciona una de las siguientes opciones:

        • Para usar la capacidad de reserva de forma opcional, selecciona Usar selección automática. (Esta opción está seleccionada de forma predeterminada).

          La instancia intenta usar capacidad de una reserva de consumo automático, lo que solo sucede si hay capacidad de reserva coincidente disponible. De lo contrario, la instancia usa capacidad a pedido.

        • Para requerir capacidad de reserva, selecciona Elegir una reserva y, luego, haz clic en Elegir reserva para especificar qué reserva usar.

          La instancia debe usar capacidad de una reserva específicamente segmentada y no puede usar capacidad según demanda. Si la capacidad de reserva no está disponible, la creación de la instancia fallará.

    A pedido

    1. En la sección Modelo de aprovisionamiento, en la lista Modelo de aprovisionamiento de VM, selecciona Estándar. (Esta opción está seleccionada de forma predeterminada).
    2. Opcional: Para configurar si esta VM usa reservas, completa los siguientes pasos:

      1. En el menú de navegación, haz clic en Opciones avanzadas.
      2. En Reservations, selecciona una de las siguientes opciones:

        • Para usar la capacidad de reserva de forma opcional, selecciona Usar selección automática. (Esta opción está seleccionada de forma predeterminada).

          La instancia intenta usar capacidad de una reserva de consumo automático, lo que solo sucede si hay capacidad de reserva coincidente disponible. De lo contrario, la instancia usa capacidad a pedido.

        • Para solicitar capacidad según demanda, selecciona No usar una reserva.

          Se bloquea el uso de cualquier capacidad de reserva de la instancia.

    Inicio flexible

    1. En la sección Modelo de aprovisionamiento, en la lista Modelo de aprovisionamiento de VM, selecciona inicio flexible.
    2. En el campo Ingresa la cantidad de horas, ingresa la cantidad máxima de tiempo que deseas que se ejecute la VM. El valor debe estar entre 46 segundos (0.01) y siete días (168 o 168 horas).

    3. Selecciona Establece un tiempo de espera para la creación de la VM.

      Según los requisitos zonales de tu carga de trabajo, especifica una de las siguientes duraciones para aumentar las probabilidades de que se complete tu solicitud de creación de VM:

      • Cargas de trabajo con requisitos zonales estrictos: Si tu carga de trabajo requiere que crees la VM en una zona específica, especifica una duración entre 90 segundos y 2 horas. Las duraciones más largas te brindan más probabilidades de obtener recursos.
      • Cargas de trabajo sin requisitos zonales estrictos: Si la VM puede ejecutarse en cualquier zona de la región, especifica una duración de 0 segundos o desmarca la casilla de verificación Establecer un tiempo de espera para la creación de la VM. Esta acción especifica que Compute Engine solo asigna recursos si están disponibles de inmediato. Si la solicitud de creación de la VM falla porque los recursos no están disponibles, vuelve a intentarlo en otra zona.

    4. En el campo Cuando se finaliza la VM, selecciona si deseas detener o borrar la VM al final de su duración de ejecución:

      • Para borrar la VM, selecciona Borrar.
      • Para detener la VM, selecciona Detener.

    Spot

    1. En la sección Modelo de aprovisionamiento, selecciona Spot en la lista Modelo de aprovisionamiento de VM.
    2. Opcional: Para seleccionar la acción de finalización que se produce cuando Compute Engine interrumpe la VM, completa los siguientes pasos:

      1. Expande la sección Configuración avanzada del modelo de aprovisionamiento de VMs.
      2. En la lista Finalización de VM, selecciona una de las siguientes opciones:
        • Para detener la VM durante la interrupción, selecciona Detener (predeterminado).
        • Para borrar la VM durante la interrupción, selecciona Borrar.
  6. En el menú de navegación, haz clic en SO y almacenamiento y, luego, completa los siguientes pasos:

    1. Haz clic en Cambiar. Se abrirá el panel Configuración del disco de arranque.
    2. En la pestaña Imágenes públicas, selecciona una imagen recomendada. Para obtener una lista de las imágenes recomendadas, consulta Sistemas operativos.

    3. Opcional: Para configurar el tamaño del disco de arranque, consulta los límites de tamaño de Google Cloud Hyperdisk o los límites de tamaño de Persistent Disk, según el tipo de disco.

    4. Para confirmar las opciones del disco de arranque, haz clic en Seleccionar.

    5. Opcional: Si deseas agregar discos SSD locales, completa los siguientes pasos:

      1. Haz clic en Agregar un SSD local. Se abrirá el panel Configurar SSD local.
      2. En el panel Configurar SSD local, configura las opciones para los discos SSD locales. Para obtener más información, consulta Cómo agregar un disco SSD local a tu instancia de procesamiento en la documentación de Compute Engine.
      3. Para confirmar las opciones del disco de arranque, haz clic en Guardar.

      Después de crear una VM con discos SSD locales, debes formatear y activar cada dispositivo antes de poder usarlo.

  7. Configura la cuenta de servicio y los permisos de acceso de la siguiente manera. Las cargas de trabajo que se ejecutan en la instancia usan la cuenta de servicio adjunta para autorizar solicitudes a otros servicios de Google Cloud .

    1. En el menú de navegación, haz clic en Seguridad.
    2. En la lista Cuenta de servicio, selecciona una cuenta de servicio para usar.
    3. En Permisos de acceso, selecciona la opción Permitir el acceso total a todas las APIs de Cloud. Esta práctica recomendada te permite administrar el acceso agregando o quitando roles de IAM de la cuenta de servicio. Para obtener más información, consulta Conecta una cuenta de servicio a una instancia.
  8. Para crear y, también, iniciar la VM, haz clic en Crear.

gcloud

Para crear la VM, usa el comando gcloud compute instances create.

Los parámetros que debes especificar dependen de la opción de consumo que uses para esta implementación. Selecciona la pestaña que corresponda a tu opción de consumo.

Reserva

Las instancias de G2 admiten los siguientes tipos de reservas:

  • Reservas según demanda
  • Reservas futuras estándar

Para consumir estos tipos de reservas, una instancia debe usar el modelo de aprovisionamiento estándar. Por ejemplo, usa los siguientes parámetros de creación.

Antes de ejecutar el comando, revisa todos los pasos que se indican a continuación para determinar si debes incluir marcas adicionales.

gcloud compute instances create INSTANCE_NAME  \
    --machine-type=MACHINE_TYPE \
    --image-family=IMAGE_FAMILY \
    --image-project=IMAGE_PROJECT \
    --zone=ZONE \
    --boot-disk-type=DISK_TYPE \
    --boot-disk-size=DISK_SIZE \
    --scopes=cloud-platform \
    --provisioning-model=STANDARD \
    --maintenance-policy=TERMINATE \
    --reservation-affinity=RESERVATION_AFFINITY \
    --reservation=RESERVATION

Completa los siguientes pasos:

  1. Reemplaza lo siguiente:

    • INSTANCE_NAME: el nombre de la VM.
    • MACHINE_TYPE: Es el tipo de máquina que se usará para la VM. Para obtener más información, consulta Tipos de máquinas con GPU en la documentación de Compute Engine.
    • IMAGE_FAMILY: Es la familia de imágenes de la imagen de SO que deseas usar. Para obtener una lista de todos los sistemas operativos compatibles, consulta Sistemas operativos compatibles.
    • IMAGE_PROJECT: Es el ID del proyecto de la imagen de SO.
    • ZONE: Es la zona en la que está disponible el tipo de máquina que deseas usar. Para especificar una política de posición compacta, usa una zona en la misma región que la política de posición compacta. Para obtener información sobre las regiones, consulta Disponibilidad de GPU por regiones y zonas.
    • DISK_TYPE: El tipo de disco de arranque. Para obtener más información sobre los tipos de discos compatibles con tu tipo de máquina, consulta Máquinas con GPU en la familia de máquinas optimizadas para aceleradores en la documentación de Compute Engine.
    • DISK_SIZE: Es el tamaño del disco de arranque en GB. Para obtener más información, consulta Límites de tamaño de Google Cloud Hyperdisk o Límites de tamaño de Persistent Disk, según el tipo de disco.
    • RESERVATION_AFFINITY: Indica qué reservas puede consumir la instancia, si es posible. Especifica una de las siguientes opciones:

      • any (la capacidad de reserva es opcional): Esta es la opción predeterminada. La instancia intenta usar capacidad de una reserva de consumo automático, lo que solo sucede si hay capacidad de reserva coincidente disponible. De lo contrario, la instancia usa capacidad a pedido.

      • specific (Se requiere capacidad de reserva): Requiere que la instancia use capacidad de una reserva orientada específicamente. La instancia no puede usar la capacidad según demanda. Si la capacidad de reserva no está disponible, la creación de la instancia fallará.

    • RESERVATION: Es la reserva que se usará. Especifica una de las siguientes opciones según el valor que especificaste para RESERVATION_AFFINITY:

      • Si especificaste any, reemplaza RESERVATION por una cadena vacía (""). Como alternativa, puedes quitar la marca --reservation por completo.
      • Si especificaste specific, reemplaza RESERVATION por lo siguiente:

        projects/RESERVATION_OWNER_PROJECT_ID/reservations/RESERVATION_NAME

        Reemplaza lo siguiente:

        • RESERVATION_OWNER_PROJECT_ID: Es el ID del proyecto en el que se creó la reserva.
        • RESERVATION_NAME por el nombre de la reserva.
  2. De forma predeterminada, la instancia se reinicia automáticamente si falla o si Compute Engine la detiene por una detención programada, como un evento de mantenimiento. Si quieres inhabilitar el reinicio automático, agrega la siguiente marca:

    --no-restart-on-failure
  3. Opcional: Para usar una política de posición compacta, agrega la siguiente marca:

      --resource-policies=POLICY_NAME
    

    Reemplaza lo siguiente:

    • POLICY_NAME: el nombre de la política de posición compacta.
  4. Opcional: Para conectar discos SSD locales, agrega la siguiente marca --local-ssd para cada disco SSD local.

    Asegúrate de que la cantidad de discos SSD locales que conectes esté permitida para tu tipo de máquina. Para obtener más detalles, consulta Acerca de los discos SSD locales en la documentación de Compute Engine.

    --local-ssd interface=INTERFACE_TYPE
    

    Reemplaza lo siguiente:

    • INTERFACE_TYPE: Es el tipo de interfaz de disco que deseas usar para el disco SSD local. Si tu imagen de disco de arranque tiene controladores NVMe optimizados, especifica NVME. Especifica SCSI para otras imágenes.

    Después de crear una VM con discos SSD locales, debes formatear y activar cada dispositivo antes de poder usarlo.

  5. Opcional: Para usar la estación de trabajo virtual (vWS) NVIDIA RTX, agrega la siguiente marca.

    Cuando creas una instancia que usa la estación de trabajo virtual NVIDIA RTX, Compute Engine agrega automáticamente una licencia de vWS. Para obtener información sobre los precios de las estaciones de trabajo virtuales, consulta la página de precios de GPU.

    --accelerator=type=nvidia-l4-vws,count=VWS_ACCELERATOR_COUNT
    

    Reemplaza VWS_ACCELERATOR_COUNT por la cantidad de GPU virtuales que deseas.

  6. Ejecute el comando.

A pedido

Antes de ejecutar el comando, revisa todos los pasos que se indican a continuación para determinar si debes incluir marcas adicionales.

gcloud compute instances create INSTANCE_NAME  \
    --machine-type=MACHINE_TYPE \
    --image-family=IMAGE_FAMILY \
    --image-project=IMAGE_PROJECT \
    --zone=ZONE \
    --boot-disk-type=DISK_TYPE \
    --boot-disk-size=DISK_SIZE \
    --scopes=cloud-platform \
    --provisioning-model=STANDARD \
    --maintenance-policy=TERMINATE \
    --reservation-affinity=RESERVATION_AFFINITY

Completa los siguientes pasos:

  1. Reemplaza lo siguiente:

    • INSTANCE_NAME: el nombre de la VM.
    • MACHINE_TYPE: Es el tipo de máquina que se usará para la VM. Para obtener más información, consulta Tipos de máquinas con GPU en la documentación de Compute Engine.
    • IMAGE_FAMILY: Es la familia de imágenes de la imagen de SO que deseas usar. Para obtener una lista de todos los sistemas operativos compatibles, consulta Sistemas operativos compatibles.
    • IMAGE_PROJECT: Es el ID del proyecto de la imagen de SO.
    • ZONE: Es la zona en la que está disponible el tipo de máquina que deseas usar. Para especificar una política de posición compacta, usa una zona en la misma región que la política de posición compacta. Para obtener información sobre las regiones, consulta Disponibilidad de GPU por regiones y zonas.
    • DISK_TYPE: El tipo de disco de arranque. Para obtener más información sobre los tipos de discos compatibles con tu tipo de máquina, consulta Máquinas con GPU en la familia de máquinas optimizadas para aceleradores en la documentación de Compute Engine.
    • DISK_SIZE: Es el tamaño del disco de arranque en GB. Para obtener más información, consulta Límites de tamaño de Google Cloud Hyperdisk o Límites de tamaño de Persistent Disk, según el tipo de disco.
    • RESERVATION_AFFINITY: Indica qué reservas puede consumir la instancia, si es posible. Especifica una de las siguientes opciones:

      • any (la capacidad de reserva es opcional): Esta es la opción predeterminada. La instancia intenta usar capacidad de una reserva de consumo automático, lo que solo sucede si hay capacidad de reserva coincidente disponible. De lo contrario, la instancia usa capacidad a pedido.

      • none (Se requiere capacidad según demanda): Bloquea la instancia para que no use ninguna capacidad de reserva.

  2. De forma predeterminada, la instancia se reinicia automáticamente si falla o si Compute Engine la detiene por una detención programada, como un evento de mantenimiento. Si quieres inhabilitar el reinicio automático, agrega la siguiente marca:

    --no-restart-on-failure
  3. Opcional: Para usar una política de posición compacta, agrega la siguiente marca:

      --resource-policies=POLICY_NAME
    

    Reemplaza lo siguiente:

    • POLICY_NAME: el nombre de la política de posición compacta.
  4. Opcional: Para conectar discos SSD locales, agrega la siguiente marca --local-ssd para cada disco SSD local.

    Asegúrate de que la cantidad de discos SSD locales que conectes esté permitida para tu tipo de máquina. Para obtener más detalles, consulta Acerca de los discos SSD locales en la documentación de Compute Engine.

    --local-ssd interface=INTERFACE_TYPE
    

    Reemplaza lo siguiente:

    • INTERFACE_TYPE: Es el tipo de interfaz de disco que deseas usar para el disco SSD local. Si tu imagen de disco de arranque tiene controladores NVMe optimizados, especifica NVME. Especifica SCSI para otras imágenes.

    Después de crear una VM con discos SSD locales, debes formatear y activar cada dispositivo antes de poder usarlo.

  5. Opcional: Para usar la estación de trabajo virtual (vWS) NVIDIA RTX, agrega la siguiente marca.

    Cuando creas una instancia que usa la estación de trabajo virtual NVIDIA RTX, Compute Engine agrega automáticamente una licencia de vWS. Para obtener información sobre los precios de las estaciones de trabajo virtuales, consulta la página de precios de GPU.

    --accelerator=type=nvidia-l4-vws,count=VWS_ACCELERATOR_COUNT
    

    Reemplaza VWS_ACCELERATOR_COUNT por la cantidad de GPU virtuales que deseas.

  6. Ejecute el comando.

Inicio flexible

Antes de ejecutar el comando, revisa todos los pasos que se indican a continuación para determinar si debes incluir marcas adicionales.

gcloud compute instances create INSTANCE_NAME  \
    --machine-type=MACHINE_TYPE \
    --image-family=IMAGE_FAMILY \
    --image-project=IMAGE_PROJECT \
    --zone=ZONE \
    --boot-disk-type=DISK_TYPE \
    --boot-disk-size=DISK_SIZE \
    --scopes=cloud-platform \
    --reservation-affinity=none \
    --provisioning-model=FLEX_START \
    --request-valid-for-duration=REQUEST_VALID_FOR_DURATION \
    --max-run-duration=MAX_RUN_DURATION \
    --instance-termination-action=TERMINATION_ACTION \
    --maintenance-policy=TERMINATE

Completa los siguientes pasos:

  1. Reemplaza lo siguiente:

    • INSTANCE_NAME: el nombre de la VM.
    • MACHINE_TYPE: Es el tipo de máquina que se usará para la VM. Para obtener más información, consulta Tipos de máquinas con GPU en la documentación de Compute Engine.
    • IMAGE_FAMILY: Es la familia de imágenes de la imagen de SO que deseas usar. Para obtener una lista de todos los sistemas operativos compatibles, consulta Sistemas operativos compatibles.
    • IMAGE_PROJECT: Es el ID del proyecto de la imagen de SO.
    • ZONE: Es la zona en la que está disponible el tipo de máquina que deseas usar. Para especificar una política de posición compacta, usa una zona en la misma región que la política de posición compacta. Para obtener información sobre las regiones, consulta Disponibilidad de GPU por regiones y zonas.
    • DISK_TYPE: El tipo de disco de arranque. Para obtener más información sobre los tipos de discos compatibles con tu tipo de máquina, consulta Máquinas con GPU en la familia de máquinas optimizadas para aceleradores en la documentación de Compute Engine.
    • DISK_SIZE: Es el tamaño del disco de arranque en GB. Para obtener más información, consulta Límites de tamaño de Google Cloud Hyperdisk o Límites de tamaño de Persistent Disk, según el tipo de disco.
    • REQUEST_VALID_FOR_DURATION: Es el tiempo durante el que sigue siendo válida la solicitud para crear la VM. Debes darle formato al valor como la cantidad de días, horas, minutos o segundos, seguidos de d, h, m y s, respectivamente. Por ejemplo, especifica 30m para 30 minutos o 1h2m3s para una hora, dos minutos y tres segundos.

      Según los requisitos zonales de tu carga de trabajo, especifica una de las siguientes duraciones para aumentar las probabilidades de que se complete tu solicitud de creación de VM:

      • Cargas de trabajo con requisitos zonales estrictos: Si tu carga de trabajo requiere que crees la VM en una zona específica, especifica una duración entre 90 segundos (90s) y dos horas (2h). Las duraciones más largas te brindan más posibilidades de obtener recursos.
      • Cargas de trabajo sin requisitos zonales estrictos: Si la VM puede ejecutarse en cualquier zona de la región, especifica una duración de cero segundos (0s). Esta acción especifica que Compute Engine solo asigna recursos si están disponibles de inmediato. Si la solicitud de creación de la VM falla porque los recursos no están disponibles, vuelve a intentarlo en otra zona.
    • MAX_RUN_DURATION: Es el tiempo durante el cual deseas que se ejecuten las VMs solicitadas. Debes darle formato al valor como la cantidad de días, horas, minutos o segundos, seguidos de d, h, m y s, respectivamente. El valor debe ser de entre 10 minutos y siete días.

    • TERMINATION_ACTION: Indica si Compute Engine detiene (STOP) o borra (DELETE) la VM al final de su duración de ejecución.

  2. Opcional: Para usar una política de posición compacta, agrega la siguiente marca:

      --resource-policies=POLICY_NAME
    

    Reemplaza lo siguiente:

    • POLICY_NAME: el nombre de la política de posición compacta.
  3. Opcional: Para conectar discos SSD locales, agrega la siguiente marca --local-ssd para cada disco SSD local.

    Asegúrate de que la cantidad de discos SSD locales que conectes esté permitida para tu tipo de máquina. Para obtener más detalles, consulta Acerca de los discos SSD locales en la documentación de Compute Engine.

    --local-ssd interface=INTERFACE_TYPE
    

    Reemplaza lo siguiente:

    • INTERFACE_TYPE: Es el tipo de interfaz de disco que deseas usar para el disco SSD local. Si tu imagen de disco de arranque tiene controladores NVMe optimizados, especifica NVME. Especifica SCSI para otras imágenes.

    Después de crear una VM con discos SSD locales, debes formatear y activar cada dispositivo antes de poder usarlo.

  4. Opcional: Para usar la estación de trabajo virtual (vWS) NVIDIA RTX, agrega la siguiente marca.

    Cuando creas una instancia que usa la estación de trabajo virtual NVIDIA RTX, Compute Engine agrega automáticamente una licencia de vWS. Para obtener información sobre los precios de las estaciones de trabajo virtuales, consulta la página de precios de GPU.

    --accelerator=type=nvidia-l4-vws,count=VWS_ACCELERATOR_COUNT
    

    Reemplaza VWS_ACCELERATOR_COUNT por la cantidad de GPU virtuales que deseas.

  5. Ejecute el comando.

Spot

Antes de ejecutar el comando, revisa todos los pasos que se indican a continuación para determinar si debes incluir marcas adicionales.

gcloud compute instances create INSTANCE_NAME  \
    --machine-type=MACHINE_TYPE \
    --image-family=IMAGE_FAMILY \
    --image-project=IMAGE_PROJECT \
    --zone=ZONE \
    --boot-disk-type=DISK_TYPE \
    --boot-disk-size=DISK_SIZE \
    --scopes=cloud-platform \
    --provisioning-model=SPOT \
    --instance-termination-action=TERMINATION_ACTION \
    --maintenance-policy=TERMINATE \
    --no-restart-on-failure

Completa los siguientes pasos:

  1. Reemplaza lo siguiente:

    • INSTANCE_NAME: el nombre de la VM.
    • MACHINE_TYPE: Es el tipo de máquina que se usará para la VM. Para obtener más información, consulta Tipos de máquinas con GPU en la documentación de Compute Engine.
    • IMAGE_FAMILY: Es la familia de imágenes de la imagen de SO que deseas usar. Para obtener una lista de todos los sistemas operativos compatibles, consulta Sistemas operativos compatibles.
    • IMAGE_PROJECT: Es el ID del proyecto de la imagen de SO.
    • ZONE: Es la zona en la que está disponible el tipo de máquina que deseas usar. Para especificar una política de posición compacta, usa una zona en la misma región que la política de posición compacta. Para obtener información sobre las regiones, consulta Disponibilidad de GPU por regiones y zonas.
    • DISK_TYPE: El tipo de disco de arranque. Para obtener más información sobre los tipos de discos compatibles con tu tipo de máquina, consulta Máquinas con GPU en la familia de máquinas optimizadas para aceleradores en la documentación de Compute Engine.
    • DISK_SIZE: Es el tamaño del disco de arranque en GB. Para obtener más información, consulta Límites de tamaño de Google Cloud Hyperdisk o Límites de tamaño de Persistent Disk, según el tipo de disco.
    • TERMINATION_ACTION: Es la acción que se debe realizar cuando Compute Engine interrumpe la instancia, ya sea STOP (predeterminada) o DELETE.

  2. Opcional: Para usar una política de posición compacta, agrega la siguiente marca:

      --resource-policies=POLICY_NAME
    

    Reemplaza lo siguiente:

    • POLICY_NAME: el nombre de la política de posición compacta.
  3. Opcional: Para conectar discos SSD locales, agrega la siguiente marca --local-ssd para cada disco SSD local.

    Asegúrate de que la cantidad de discos SSD locales que conectes esté permitida para tu tipo de máquina. Para obtener más detalles, consulta Acerca de los discos SSD locales en la documentación de Compute Engine.

    --local-ssd interface=INTERFACE_TYPE
    

    Reemplaza lo siguiente:

    • INTERFACE_TYPE: Es el tipo de interfaz de disco que deseas usar para el disco SSD local. Si tu imagen de disco de arranque tiene controladores NVMe optimizados, especifica NVME. Especifica SCSI para otras imágenes.

    Después de crear una VM con discos SSD locales, debes formatear y activar cada dispositivo antes de poder usarlo.

  4. Opcional: Para usar la estación de trabajo virtual (vWS) NVIDIA RTX, agrega la siguiente marca.

    Cuando creas una instancia que usa la estación de trabajo virtual NVIDIA RTX, Compute Engine agrega automáticamente una licencia de vWS. Para obtener información sobre los precios de las estaciones de trabajo virtuales, consulta la página de precios de GPU.

    --accelerator=type=nvidia-l4-vws,count=VWS_ACCELERATOR_COUNT
    

    Reemplaza VWS_ACCELERATOR_COUNT por la cantidad de GPU virtuales que deseas.

  5. Ejecute el comando.

REST

Para crear la VM, realiza una solicitud POST al método instances.insert.

Los parámetros que debes especificar dependen de la opción de consumo que uses para esta implementación. Selecciona la pestaña que corresponda a tu opción de consumo.

Reserva

Las instancias de G2 admiten los siguientes tipos de reservas:

  • Reservas según demanda
  • Reservas futuras estándar

Para consumir estos tipos de reservas, una instancia debe usar el modelo de aprovisionamiento estándar. Por ejemplo, usa los siguientes parámetros de creación.

Antes de enviar la solicitud, revisa todos los pasos que se indican a continuación para determinar si debes incluir campos adicionales.

POST https://compute.googleapis.com/compute/v1/projects/PROJECT_ID/zones/ZONE/instances
{
  "machineType": "projects/PROJECT_ID/zones/ZONE/machineTypes/MACHINE_TYPE",
  "name": "INSTANCE_NAME",
  "disks": [
    {
      "boot": true,
      "initializeParams": {
        "diskSizeGb": "DISK_SIZE",
        "diskType": "DISK_TYPE",
        "sourceImage": "projects/IMAGE_PROJECT/global/images/family/IMAGE_FAMILY"
      },
      "mode": "READ_WRITE",
      "type": "PERSISTENT"
    }
  ],
  "serviceAccounts": [
    {
      "email": "default",
      "scopes": [
        "https://www.googleapis.com/auth/cloud-platform"
      ]
    }
  ],
  "scheduling": {
    "provisioningModel": "STANDARD",
    "onHostMaintenance": "TERMINATE",
    "automaticRestart": AUTOMATIC_RESTART
  },
  "reservationAffinity": {
    "consumeReservationType": "RESERVATION_AFFINITY",
    "key": "compute.googleapis.com/reservation-name",
    "values": [
      "RESERVATION"
    ]
  }
}

Completa los siguientes pasos:

  1. Reemplaza lo siguiente:

    • PROJECT_ID: Es el ID del proyecto en el que deseas crear la VM.
    • ZONE: Es la zona en la que está disponible el tipo de máquina que deseas usar. Si deseas especificar una política de posición compacta, debes usar una zona en la misma región que la política de posición compacta. Para obtener información sobre las regiones, consulta Disponibilidad de GPU por regiones y zonas.
    • MACHINE_TYPE: Es el tipo de máquina que se usará para la VM. Para obtener más información, consulta Tipos de máquinas con GPU en la documentación de Compute Engine.
    • INSTANCE_NAME: el nombre de la VM.
    • DISK_SIZE: Es el tamaño del disco de arranque en GB. Para obtener más información, consulta Límites de tamaño de Google Cloud Hyperdisk o Límites de tamaño de Persistent Disk, según el tipo de disco.
    • DISK_TYPE: El tipo de disco de arranque. Para obtener más información sobre los tipos de discos compatibles con tu tipo de máquina, consulta Máquinas con GPU en la familia de máquinas optimizadas para aceleradores en la documentación de Compute Engine.
    • IMAGE_PROJECT: Es el ID del proyecto de la imagen de SO.
    • IMAGE_FAMILY: Es la familia de imágenes de la imagen de SO que deseas usar. Para obtener una lista de todos los sistemas operativos compatibles, consulta Sistemas operativos compatibles.
    • AUTOMATIC_RESTART: Indica si la instancia se reinicia automáticamente si falla o si Compute Engine la detiene por una detención programada, como un evento de mantenimiento. Especifica true para habilitar el reinicio automático (predeterminado) o false para inhabilitarlo.

    • RESERVATION_AFFINITY: Indica qué reservas puede consumir la instancia, si es posible. Especifica una de las siguientes opciones:

      • ANY_RESERVATION (la capacidad de reserva es opcional): Esta es la opción predeterminada. La instancia intenta usar capacidad de una reserva que se consume automáticamente, lo que solo sucede si hay capacidad de reserva coincidente disponible. De lo contrario, la instancia usa capacidad a pedido.

      • SPECIFIC_RESERVATION (Se requiere capacidad de reserva): Requiere que la instancia use capacidad de una reserva orientada específicamente. La instancia no puede usar la capacidad según demanda. Si la capacidad de reserva no está disponible, la creación de la instancia fallará.

    • RESERVATION: Es la reserva que se usará. Especifica una de las siguientes opciones según el valor que especificaste para RESERVATION_AFFINITY:

      • Si especificaste ANY_RESERVATION, borra RESERVATION para que el valor sea una cadena vacía (""). Como alternativa, puedes quitar por completo los campos key y values.
      • Si especificaste SPECIFIC_RESERVATION, reemplaza RESERVATION por lo siguiente:

        projects/RESERVATION_OWNER_PROJECT_ID/reservations/RESERVATION_NAME

        Reemplaza lo siguiente:

        • RESERVATION_OWNER_PROJECT_ID: Es el ID del proyecto en el que se creó la reserva.
        • RESERVATION_NAME por el nombre de la reserva.
  2. Opcional: Si elegiste usar una política de posición compacta, agrega el siguiente campo al cuerpo de la solicitud:

      "resourcePolicies": [
        "projects/PROJECT_ID/regions/REGION/resourcePolicies/POLICY_NAME"
      ]
    

    Reemplaza lo siguiente:

    • PROJECT_ID: Es el ID del proyecto de la política de posición compacta.
    • REGION: Es la región de la política de posición compacta.
    • POLICY_NAME: el nombre de la política de posición compacta.
  3. Opcional: Para usar discos SSD locales, agrega el siguiente campo al campo disks[] para cada disco SSD local. Separa cada subcampo disks[] (incluido el disco de arranque) con una coma.

    Asegúrate de que la cantidad de discos SSD locales que conectes esté permitida para tu tipo de máquina. Para obtener más detalles, consulta Acerca de los discos SSD locales en la documentación de Compute Engine.

        {
           "type": "SCRATCH",
           "initializeParams": {
              "diskType": "zones/ZONE/diskTypes/local-ssd"
           },
           "autoDelete": true,
           "interface": "INTERFACE_TYPE"
        }
    

    Reemplaza lo siguiente:

    • ZONE: La zona que especificaste.
    • INTERFACE_TYPE: Es el tipo de interfaz de disco que deseas usar para el disco SSD local. Si tu imagen de disco de arranque tiene controladores NVMe optimizados, especifica NVME. Especifica SCSI para otras imágenes.

    Después de crear una VM con discos SSD locales, debes formatear y activar cada dispositivo antes de poder usarlo.

  4. Opcional: Para usar la estación de trabajo virtual (vWS) NVIDIA RTX, agrega el siguiente campo.

    Cuando creas una instancia que usa la estación de trabajo virtual NVIDIA RTX, Compute Engine agrega automáticamente una licencia de vWS. Para obtener información sobre los precios de las estaciones de trabajo virtuales, consulta la página de precios de GPU.

    "guestAccelerators":
      [
        {
          "acceleratorCount": VWS_ACCELERATOR_COUNT,
          "acceleratorType": "projects/PROJECT_ID/zones/ZONE/acceleratorTypes/nvidia-l4-vws"
        }
      ]
    

    Reemplaza VWS_ACCELERATOR_COUNT por la cantidad de GPU virtuales que deseas.

  5. Envía la solicitud.

A pedido

Antes de enviar la solicitud, revisa todos los pasos que se indican a continuación para determinar si debes incluir campos adicionales.

POST https://compute.googleapis.com/compute/v1/projects/PROJECT_ID/zones/ZONE/instances
{
  "machineType": "projects/PROJECT_ID/zones/ZONE/machineTypes/MACHINE_TYPE",
  "name": "INSTANCE_NAME",
  "disks": [
    {
      "boot": true,
      "initializeParams": {
        "diskSizeGb": "DISK_SIZE",
        "diskType": "DISK_TYPE",
        "sourceImage": "projects/IMAGE_PROJECT/global/images/family/IMAGE_FAMILY"
      },
      "mode": "READ_WRITE",
      "type": "PERSISTENT"
    }
  ],
  "serviceAccounts": [
    {
      "email": "default",
      "scopes": [
        "https://www.googleapis.com/auth/cloud-platform"
      ]
    }
  ],
  "scheduling": {
    "provisioningModel": "STANDARD",
    "onHostMaintenance": "TERMINATE",
    "automaticRestart": AUTOMATIC_RESTART
  },
  "reservationAffinity": {
    "consumeReservationType": "RESERVATION_AFFINITY"
  }
}

Completa los siguientes pasos:

  1. Reemplaza lo siguiente:

    • PROJECT_ID: Es el ID del proyecto en el que deseas crear la VM.
    • ZONE: Es la zona en la que está disponible el tipo de máquina que deseas usar. Si deseas especificar una política de posición compacta, debes usar una zona en la misma región que la política de posición compacta. Para obtener información sobre las regiones, consulta Disponibilidad de GPU por regiones y zonas.
    • MACHINE_TYPE: Es el tipo de máquina que se usará para la VM. Para obtener más información, consulta Tipos de máquinas con GPU en la documentación de Compute Engine.
    • INSTANCE_NAME: el nombre de la VM.
    • DISK_SIZE: Es el tamaño del disco de arranque en GB. Para obtener más información, consulta Límites de tamaño de Google Cloud Hyperdisk o Límites de tamaño de Persistent Disk, según el tipo de disco.
    • DISK_TYPE: El tipo de disco de arranque. Para obtener más información sobre los tipos de discos compatibles con tu tipo de máquina, consulta Máquinas con GPU en la familia de máquinas optimizadas para aceleradores en la documentación de Compute Engine.
    • IMAGE_PROJECT: Es el ID del proyecto de la imagen de SO.
    • IMAGE_FAMILY: Es la familia de imágenes de la imagen de SO que deseas usar. Para obtener una lista de todos los sistemas operativos compatibles, consulta Sistemas operativos compatibles.
    • AUTOMATIC_RESTART: Indica si la instancia se reinicia automáticamente si falla o si Compute Engine la detiene por una detención programada, como un evento de mantenimiento. Especifica true para habilitar el reinicio automático (predeterminado) o false para inhabilitarlo.

    • RESERVATION_AFFINITY: Indica qué reservas puede consumir la instancia, si es posible. Especifica una de las siguientes opciones:

      • ANY_RESERVATION (la capacidad de reserva es opcional): Esta es la opción predeterminada. La instancia intenta usar capacidad de una reserva que se consume automáticamente, lo que solo sucede si hay capacidad de reserva coincidente disponible. De lo contrario, la instancia usa capacidad a pedido.

      • NO_RESERVATION (Se requiere capacidad según demanda): Bloquea la instancia para que no use ninguna capacidad de reserva.

  2. Opcional: Si elegiste usar una política de posición compacta, agrega el siguiente campo al cuerpo de la solicitud:

      "resourcePolicies": [
        "projects/PROJECT_ID/regions/REGION/resourcePolicies/POLICY_NAME"
      ]
    

    Reemplaza lo siguiente:

    • PROJECT_ID: Es el ID del proyecto de la política de posición compacta.
    • REGION: Es la región de la política de posición compacta.
    • POLICY_NAME: el nombre de la política de posición compacta.
  3. Opcional: Para usar discos SSD locales, agrega el siguiente campo al campo disks[] para cada disco SSD local. Separa cada subcampo disks[] (incluido el disco de arranque) con una coma.

    Asegúrate de que la cantidad de discos SSD locales que conectes esté permitida para tu tipo de máquina. Para obtener más detalles, consulta Acerca de los discos SSD locales en la documentación de Compute Engine.

        {
           "type": "SCRATCH",
           "initializeParams": {
              "diskType": "zones/ZONE/diskTypes/local-ssd"
           },
           "autoDelete": true,
           "interface": "INTERFACE_TYPE"
        }
    

    Reemplaza lo siguiente:

    • ZONE: La zona que especificaste.
    • INTERFACE_TYPE: Es el tipo de interfaz de disco que deseas usar para el disco SSD local. Si tu imagen de disco de arranque tiene controladores NVMe optimizados, especifica NVME. Especifica SCSI para otras imágenes.

    Después de crear una VM con discos SSD locales, debes formatear y activar cada dispositivo antes de poder usarlo.

  4. Opcional: Para usar la estación de trabajo virtual (vWS) NVIDIA RTX, agrega el siguiente campo.

    Cuando creas una instancia que usa la estación de trabajo virtual NVIDIA RTX, Compute Engine agrega automáticamente una licencia de vWS. Para obtener información sobre los precios de las estaciones de trabajo virtuales, consulta la página de precios de GPU.

    "guestAccelerators":
      [
        {
          "acceleratorCount": VWS_ACCELERATOR_COUNT,
          "acceleratorType": "projects/PROJECT_ID/zones/ZONE/acceleratorTypes/nvidia-l4-vws"
        }
      ]
    

    Reemplaza VWS_ACCELERATOR_COUNT por la cantidad de GPU virtuales que deseas.

  5. Envía la solicitud.

Inicio flexible

Antes de enviar la solicitud, revisa todos los pasos que se indican a continuación para determinar si debes incluir campos adicionales.

POST https://compute.googleapis.com/compute/v1/projects/PROJECT_ID/zones/ZONE/instances
{
  "machineType": "projects/PROJECT_ID/zones/ZONE/machineTypes/MACHINE_TYPE",
  "name": "INSTANCE_NAME",
  "disks": [
    {
      "boot": true,
      "initializeParams": {
        "diskSizeGb": "DISK_SIZE",
        "diskType": "DISK_TYPE",
        "sourceImage": "projects/IMAGE_PROJECT/global/images/family/IMAGE_FAMILY"
      },
      "mode": "READ_WRITE",
      "type": "PERSISTENT"
    }
  ],
  "serviceAccounts": [
    {
      "email": "default",
      "scopes": [
        "https://www.googleapis.com/auth/cloud-platform"
      ]
    }
  ],
  "reservationAffinity": {
    "consumeReservationType": "NO_RESERVATION",
  },
  "scheduling": {
    "provisioningModel": "FLEX_START",
    "requestValidForDuration": {
      "seconds": REQUEST_VALID_FOR_DURATION
    },
    "maxRunDuration": {
      "seconds": MAX_RUN_DURATION
    },
    "instanceTerminationAction": "TERMINATION_ACTION",
    "onHostMaintenance": "TERMINATE",
  }
}

Completa los siguientes pasos:

  1. Reemplaza lo siguiente:

    • PROJECT_ID: Es el ID del proyecto en el que deseas crear la VM.
    • ZONE: Es la zona en la que está disponible el tipo de máquina que deseas usar. Si deseas especificar una política de posición compacta, debes usar una zona en la misma región que la política de posición compacta. Para obtener información sobre las regiones, consulta Disponibilidad de GPU por regiones y zonas.
    • MACHINE_TYPE: Es el tipo de máquina que se usará para la VM. Para obtener más información, consulta Tipos de máquinas con GPU en la documentación de Compute Engine.
    • INSTANCE_NAME: el nombre de la VM.
    • DISK_SIZE: Es el tamaño del disco de arranque en GB. Para obtener más información, consulta Límites de tamaño de Google Cloud Hyperdisk o Límites de tamaño de Persistent Disk, según el tipo de disco.
    • DISK_TYPE: El tipo de disco de arranque. Para obtener más información sobre los tipos de discos compatibles con tu tipo de máquina, consulta Máquinas con GPU en la familia de máquinas optimizadas para aceleradores en la documentación de Compute Engine.
    • IMAGE_PROJECT: Es el ID del proyecto de la imagen de SO.
    • IMAGE_FAMILY: Es la familia de imágenes de la imagen de SO que deseas usar. Para obtener una lista de todos los sistemas operativos compatibles, consulta Sistemas operativos compatibles.
    • REQUEST_VALID_FOR_DURATION: Es la duración, en segundos, durante la que sigue siendo válida la solicitud para crear la VM.

      Según los requisitos zonales de tu carga de trabajo, especifica una de las siguientes duraciones para aumentar las probabilidades de que se complete tu solicitud de creación de VM:

      • Cargas de trabajo con requisitos zonales estrictos: Si tu carga de trabajo requiere que crees la VM en una zona específica, especifica una duración entre 90 segundos (90) y dos horas (7200). Las duraciones más largas te brindan más posibilidades de obtener recursos.
      • Cargas de trabajo sin requisitos zonales estrictos: Si la VM puede ejecutarse en cualquier zona de la región, especifica una duración de cero segundos (0). Esta acción especifica que Compute Engine solo asigna recursos si están disponibles de inmediato. Si la solicitud de creación de la VM falla porque los recursos no están disponibles, vuelve a intentarlo en otra zona.
    • MAX_RUN_DURATION: la duración de la que deseas que se ejecuten las VMs solicitadas. Debes darle formato al valor como la cantidad de segundos. Por ejemplo, especifica 86400 para 86,400 segundos (24 horas). El valor debe ser de entre 10 minutos y siete días.

    • TERMINATION_ACTION: Indica si Compute Engine detiene (STOP) o borra (DELETE) la VM al final de su duración de ejecución.

  2. Opcional: Si elegiste usar una política de posición compacta, agrega el siguiente campo al cuerpo de la solicitud:

      "resourcePolicies": [
        "projects/PROJECT_ID/regions/REGION/resourcePolicies/POLICY_NAME"
      ]
    

    Reemplaza lo siguiente:

    • PROJECT_ID: Es el ID del proyecto de la política de posición compacta.
    • REGION: Es la región de la política de posición compacta.
    • POLICY_NAME: el nombre de la política de posición compacta.
  3. Opcional: Para usar discos SSD locales, agrega el siguiente campo al campo disks[] para cada disco SSD local. Separa cada subcampo disks[] (incluido el disco de arranque) con una coma.

    Asegúrate de que la cantidad de discos SSD locales que conectes esté permitida para tu tipo de máquina. Para obtener más detalles, consulta Acerca de los discos SSD locales en la documentación de Compute Engine.

        {
           "type": "SCRATCH",
           "initializeParams": {
              "diskType": "zones/ZONE/diskTypes/local-ssd"
           },
           "autoDelete": true,
           "interface": "INTERFACE_TYPE"
        }
    

    Reemplaza lo siguiente:

    • ZONE: La zona que especificaste.
    • INTERFACE_TYPE: Es el tipo de interfaz de disco que deseas usar para el disco SSD local. Si tu imagen de disco de arranque tiene controladores NVMe optimizados, especifica NVME. Especifica SCSI para otras imágenes.

    Después de crear una VM con discos SSD locales, debes formatear y activar cada dispositivo antes de poder usarlo.

  4. Opcional: Para usar la estación de trabajo virtual (vWS) NVIDIA RTX, agrega el siguiente campo.

    Cuando creas una instancia que usa la estación de trabajo virtual NVIDIA RTX, Compute Engine agrega automáticamente una licencia de vWS. Para obtener información sobre los precios de las estaciones de trabajo virtuales, consulta la página de precios de GPU.

    "guestAccelerators":
      [
        {
          "acceleratorCount": VWS_ACCELERATOR_COUNT,
          "acceleratorType": "projects/PROJECT_ID/zones/ZONE/acceleratorTypes/nvidia-l4-vws"
        }
      ]
    

    Reemplaza VWS_ACCELERATOR_COUNT por la cantidad de GPU virtuales que deseas.

  5. Envía la solicitud.

Spot

Antes de enviar la solicitud, revisa todos los pasos que se indican a continuación para determinar si debes incluir campos adicionales.

POST https://compute.googleapis.com/compute/v1/projects/PROJECT_ID/zones/ZONE/instances
{
  "machineType": "projects/PROJECT_ID/zones/ZONE/machineTypes/MACHINE_TYPE",
  "name": "INSTANCE_NAME",
  "disks": [
    {
      "boot": true,
      "initializeParams": {
        "diskSizeGb": "DISK_SIZE",
        "diskType": "DISK_TYPE",
        "sourceImage": "projects/IMAGE_PROJECT/global/images/family/IMAGE_FAMILY"
      },
      "mode": "READ_WRITE",
      "type": "PERSISTENT"
    }
  ],
  "serviceAccounts": [
    {
      "email": "default",
      "scopes": [
        "https://www.googleapis.com/auth/cloud-platform"
      ]
    }
  ],
  "scheduling":
  {
    "provisioningModel": "SPOT",
    "instanceTerminationAction": "TERMINATION_ACTION",
    "onHostMaintenance": "TERMINATE",
    "automaticRestart": false
  }
}

Completa los siguientes pasos:

  1. Reemplaza lo siguiente:

    • PROJECT_ID: Es el ID del proyecto en el que deseas crear la VM.
    • ZONE: Es la zona en la que está disponible el tipo de máquina que deseas usar. Si deseas especificar una política de posición compacta, debes usar una zona en la misma región que la política de posición compacta. Para obtener información sobre las regiones, consulta Disponibilidad de GPU por regiones y zonas.
    • MACHINE_TYPE: Es el tipo de máquina que se usará para la VM. Para obtener más información, consulta Tipos de máquinas con GPU en la documentación de Compute Engine.
    • INSTANCE_NAME: el nombre de la VM.
    • DISK_SIZE: Es el tamaño del disco de arranque en GB. Para obtener más información, consulta Límites de tamaño de Google Cloud Hyperdisk o Límites de tamaño de Persistent Disk, según el tipo de disco.
    • DISK_TYPE: El tipo de disco de arranque. Para obtener más información sobre los tipos de discos compatibles con tu tipo de máquina, consulta Máquinas con GPU en la familia de máquinas optimizadas para aceleradores en la documentación de Compute Engine.
    • IMAGE_PROJECT: Es el ID del proyecto de la imagen de SO.
    • IMAGE_FAMILY: Es la familia de imágenes de la imagen de SO que deseas usar. Para obtener una lista de todos los sistemas operativos compatibles, consulta Sistemas operativos compatibles.
    • TERMINATION_ACTION: Es la acción que se debe realizar cuando Compute Engine interrumpe la instancia, ya sea STOP (predeterminada) o DELETE.

  2. Opcional: Si elegiste usar una política de posición compacta, agrega el siguiente campo al cuerpo de la solicitud:

      "resourcePolicies": [
        "projects/PROJECT_ID/regions/REGION/resourcePolicies/POLICY_NAME"
      ]
    

    Reemplaza lo siguiente:

    • PROJECT_ID: Es el ID del proyecto de la política de posición compacta.
    • REGION: Es la región de la política de posición compacta.
    • POLICY_NAME: el nombre de la política de posición compacta.
  3. Opcional: Para usar discos SSD locales, agrega el siguiente campo al campo disks[] para cada disco SSD local. Separa cada subcampo disks[] (incluido el disco de arranque) con una coma.

    Asegúrate de que la cantidad de discos SSD locales que conectes esté permitida para tu tipo de máquina. Para obtener más detalles, consulta Acerca de los discos SSD locales en la documentación de Compute Engine.

        {
           "type": "SCRATCH",
           "initializeParams": {
              "diskType": "zones/ZONE/diskTypes/local-ssd"
           },
           "autoDelete": true,
           "interface": "INTERFACE_TYPE"
        }
    

    Reemplaza lo siguiente:

    • ZONE: La zona que especificaste.
    • INTERFACE_TYPE: Es el tipo de interfaz de disco que deseas usar para el disco SSD local. Si tu imagen de disco de arranque tiene controladores NVMe optimizados, especifica NVME. Especifica SCSI para otras imágenes.

    Después de crear una VM con discos SSD locales, debes formatear y activar cada dispositivo antes de poder usarlo.

  4. Opcional: Para usar la estación de trabajo virtual (vWS) NVIDIA RTX, agrega el siguiente campo.

    Cuando creas una instancia que usa la estación de trabajo virtual NVIDIA RTX, Compute Engine agrega automáticamente una licencia de vWS. Para obtener información sobre los precios de las estaciones de trabajo virtuales, consulta la página de precios de GPU.

    "guestAccelerators":
      [
        {
          "acceleratorCount": VWS_ACCELERATOR_COUNT,
          "acceleratorType": "projects/PROJECT_ID/zones/ZONE/acceleratorTypes/nvidia-l4-vws"
        }
      ]
    

    Reemplaza VWS_ACCELERATOR_COUNT por la cantidad de GPU virtuales que deseas.

  5. Envía la solicitud.

Instalar los controladores de GPU.

Después de crear una instancia, esta no puede usar sus GPUs a menos que ya estén instalados los controladores de GPU correctos. El controlador que debes instalar depende de si la instancia habilitó la estación de trabajo virtual (vWS) NVIDIA RTX. Usa una de las siguientes opciones:

¿Qué sigue?