En este documento, se explica cómo crear instancias de máquina virtual (VM) de forma masiva que usen la serie de máquinas N1 con GPUs conectadas. Para obtener más información sobre estos tipos de máquinas optimizados para aceleradores, consulta Serie N1+GPU.
Para obtener más información sobre cómo crear VMs de forma masiva, consulta Acerca de la creación masiva de VMs en la documentación de Compute Engine.
Para obtener información sobre otras formas de crear VMs o clústeres, consulta la Descripción general de las opciones de implementación.
Limitaciones
Para conocer las limitaciones que se aplican a los tipos de máquinas N1 con GPU, consulta lo siguiente:
- Tipos de máquinas de GPU
- Máquinas con GPU en la familia de máquinas optimizadas para aceleradores
- Serie de máquinas N1
Antes de comenzar
Antes de crear VMs de forma masiva, si aún no lo hiciste, completa los siguientes pasos:
- Elige una opción de consumo: La opción de consumo que elijas determinará cómo obtendrás y usarás los recursos de GPU. Para obtener más información, consulta Elige una opción de consumo.
- Obtén capacidad: El proceso para obtener capacidad difiere para cada opción de consumo. Para obtener información sobre el proceso para obtener capacidad para la opción de consumo que elegiste, consulta Descripción general de la capacidad.
Selecciona la pestaña que corresponda a la forma en que planeas usar las muestras de esta página:
Console
Cuando usas la consola de Google Cloud para acceder a los servicios y las APIs de Google Cloud , no necesitas configurar la autenticación.
gcloud
En la consola de Google Cloud , activa Cloud Shell.
En la parte inferior de la consola de Google Cloud , se inicia una sesión de Cloud Shell en la que se muestra una ventana de línea de comandos. Cloud Shell es un entorno de shell con Google Cloud CLI ya instalada y con valores ya establecidos para el proyecto actual. La sesión puede tardar unos segundos en inicializarse.
REST
Para usar las muestras de la API de REST incluidas en esta página en un entorno de desarrollo local, debes usar las credenciales que proporciones a la gcloud CLI.
Instala Google Cloud CLI.
Si usas un proveedor de identidad externo (IdP), primero debes acceder a la gcloud CLI con tu identidad federada.
Para obtener más información, consulta Autentícate para usar REST en la documentación de autenticación de Google Cloud .
Roles obligatorios
Para obtener los permisos que necesitas
para crear VMs de forma masiva,
pídele a tu administrador que te otorgue el rol de IAM
Administrador de instancias de Compute (v1) (roles/compute.instanceAdmin.v1) en el proyecto.
Para obtener más información sobre cómo otorgar roles, consulta Administra el acceso a proyectos, carpetas y organizaciones.
Este rol predefinido contiene los permisos necesarios para crear VMs de forma masiva. Para ver los permisos exactos que son necesarios, expande la sección Permisos requeridos:
Permisos necesarios
Se requieren los siguientes permisos para crear VMs de forma masiva:
-
compute.instances.createen el proyecto -
Si deseas usar una imagen personalizada para crear la VM, sigue estos pasos:
compute.images.useReadOnlyen la imagen -
Para usar una instantánea a fin de crear la VM, haz lo siguiente:
compute.snapshots.useReadOnlyen la instantánea -
Si quieres usar una plantilla de instancias para crear la VM, sigue estos pasos:
compute.instanceTemplates.useReadOnlyen la plantilla de instancias -
A fin de especificar una subred para tu VM:
compute.subnetworks.useen el proyecto o en la subred elegida -
Si deseas especificar una dirección IP estática para la VM:
compute.addresses.useen el proyecto -
Para asignar una dirección IP externa a la VM cuando se usa una red de VPC,
compute.subnetworks.useExternalIpen el proyecto o en la subred elegida. -
Para asignar una red heredada a la VM, ejecuta
compute.networks.useen el proyecto. -
Para asignar una dirección IP externa a la VM cuando se usa una red heredada, ejecuta
compute.networks.useExternalIpen el proyecto -
Para configurar los metadatos de la instancia de VM para la VM,
compute.instances.setMetadataen el proyecto. -
Para configurar etiquetas en la VM, haz lo siguiente:
compute.instances.setTagsen la VM -
Para configurar etiquetas en la VM, haz lo siguiente:
compute.instances.setLabelsen la VM -
A fin de configurar una cuenta de servicio para que la VM use:
compute.instances.setServiceAccounten la VM -
Crear un disco nuevo para la VM:
compute.disks.createen el proyecto -
Para conectar un disco existente en modo de solo lectura o de lectura y escritura, usa
compute.disks.useen el disco. -
Para conectar un disco existente en modo de solo lectura, haz lo siguiente:
compute.disks.useReadOnlyen el disco
También puedes obtener estos permisos con roles personalizados o con otros roles predefinidos.
Descripción general
La creación masiva de instancias con el tipo de máquina N1 con GPU T4 o V100 incluye los siguientes pasos:
Crea VMs N1 con GPUs de forma masiva
Para crear VMs de N1 con GPUs de forma masiva, usa uno de los siguientes métodos.
Los siguientes comandos también establecen el permiso de acceso para tus instancias. Para simplificar la administración de permisos, Google recomienda que configures el permiso de acceso en una instancia como accesocloud-platform y, luego, uses roles de IAM para definir a qué servicios puede acceder la instancia. Para obtener más información, consulta las prácticas recomendadas para los permisos.
gcloud
Para crear instancias de forma masiva, usa el
comando gcloud compute instances bulk create.
Los parámetros que debes especificar dependen de la opción de consumo que uses para esta implementación. Selecciona la pestaña que corresponda a tu opción de consumo.
Reserva
Las instancias de N1 con GPU T4 o V100 admiten los siguientes tipos de reservas:
- Reservas según demanda
- Reservas futuras estándar
Para consumir estos tipos de reservas, una instancia debe usar el modelo de aprovisionamiento estándar. Por ejemplo, usa los siguientes parámetros de creación.
Antes de ejecutar el comando, revisa todos los pasos que se indican a continuación para determinar si debes incluir marcas adicionales.
gcloud compute instances bulk create \
--name-pattern=NAME_PATTERN \
--count=COUNT \
--machine-type=MACHINE_TYPE \
--accelerator=type=ACCELERATOR_TYPE,count=ACCELERATOR_COUNT \
--image-family=IMAGE_FAMILY \
--image-project=IMAGE_PROJECT \
--region=REGION \
--boot-disk-type=DISK_TYPE \
--boot-disk-size=DISK_SIZE \
--scopes=cloud-platform \
--provisioning-model=STANDARD \
--maintenance-policy=TERMINATE \
--reservation-affinity=RESERVATION_AFFINITY \
--reservation=RESERVATION
Completa los siguientes pasos:
-
Reemplaza lo siguiente:
NAME_PATTERN: Es el patrón de nombres que se usará para las instancias de N1 con GPU T4 o V100. Por ejemplo, si usasinstance-#para el patrón de nombre, se generan instancias de N1 con GPU T4 o V100 con nombres comoinstance-1yinstance-2, hasta la cantidad de instancias de N1 con GPU T4 o V100 especificadas por--count.COUNT: Es la cantidad de instancias de N1 con GPUs T4 o V100 que se crearán.MACHINE_TYPE: Es el tipo de máquina que se usará para la instancia de N1 con GPUs T4 o V100. Para obtener más información, consulta Tipos de máquinas con GPU en la documentación de Compute Engine.ACCELERATOR_COUNT: Es la cantidad de GPUs que deseas conectar a tu VM N1. Para obtener una lista de los límites de GPU en función del tipo de máquina de tu VM, consulta la información sobre las GPUs N1 en la documentación de Compute Engine.ACCELERATOR_TYPE: Es el tipo de acelerador para las VMs N1 que deseas usar. Para las cargas de trabajo de IA, te recomendamos que uses GPU T4 o V100.IMAGE_FAMILY: Es la familia de imágenes de la imagen de SO que deseas usar. Para obtener una lista de todos los sistemas operativos compatibles, consulta Sistemas operativos compatibles.IMAGE_PROJECT: Es el ID del proyecto de la imagen de SO.REGION: Especifica una región en la que esté disponible el tipo de máquina que deseas usar. Para obtener información sobre las regiones, consulta Disponibilidad de GPU por regiones y zonas.DISK_TYPE: El tipo de disco de arranque. Para obtener más información sobre los tipos de discos compatibles con tu tipo de máquina, consulta Máquinas con GPU en la familia de máquinas optimizadas para aceleradores en la documentación de Compute Engine.DISK_SIZE: Es el tamaño del disco de arranque en GB. Para obtener más información, consulta Límites de tamaño de Google Cloud Hyperdisk o Límites de tamaño de Persistent Disk, según el tipo de disco.RESERVATION_AFFINITY: Indica qué reservas puede consumir la instancia, si es posible. Especifica una de las siguientes opciones:any(la capacidad de reserva es opcional): Esta es la opción predeterminada. La instancia intenta usar capacidad de una reserva de consumo automático, lo que solo sucede si hay capacidad de reserva coincidente disponible. De lo contrario, la instancia usa capacidad a pedido.specific(Se requiere capacidad de reserva): Requiere que la instancia use capacidad de una reserva orientada específicamente. La instancia no puede usar la capacidad según demanda. Si la capacidad de reserva no está disponible, la creación de la instancia fallará.
RESERVATION: Es la reserva que se usará. Especifica una de las siguientes opciones según el valor que especificaste paraRESERVATION_AFFINITY:- Si especificaste
any, reemplazaRESERVATIONpor una cadena vacía (""). Como alternativa, puedes quitar la marca--reservationpor completo. Si especificaste
specific, reemplazaRESERVATIONpor lo siguiente:projects/RESERVATION_OWNER_PROJECT_ID/reservations/RESERVATION_NAME
Reemplaza lo siguiente:
RESERVATION_OWNER_PROJECT_ID: Es el ID del proyecto en el que se creó la reserva.RESERVATION_NAMEpor el nombre de la reserva.
- Si especificaste
De forma predeterminada, la instancia se reinicia automáticamente si falla o si Compute Engine la detiene por una detención programada, como un evento de mantenimiento. Si quieres inhabilitar el reinicio automático, agrega la siguiente marca:
--no-restart-on-failure
-
Opcional: Para conectar discos SSD locales, agrega la siguiente marca
--local-ssdpara cada disco SSD local.Asegúrate de que la cantidad de discos SSD locales que conectes esté permitida para tu tipo de máquina. Para obtener más detalles, consulta Acerca de los discos SSD locales en la documentación de Compute Engine.
--local-ssd interface=INTERFACE_TYPE
Reemplaza lo siguiente:
INTERFACE_TYPE: Es el tipo de interfaz de disco que deseas usar para el disco SSD local. Si tu imagen de disco de arranque tiene controladores NVMe optimizados, especificaNVME. EspecificaSCSIpara otras imágenes.
Después de crear una VM con discos SSD locales, debes formatear y activar cada dispositivo antes de poder usarlo.
- Ejecute el comando.
A pedido
Antes de ejecutar el comando, revisa todos los pasos que se indican a continuación para determinar si debes incluir marcas adicionales.
gcloud compute instances bulk create \
--name-pattern=NAME_PATTERN \
--count=COUNT \
--machine-type=MACHINE_TYPE \
--accelerator=type=ACCELERATOR_TYPE,count=ACCELERATOR_COUNT \
--image-family=IMAGE_FAMILY \
--image-project=IMAGE_PROJECT \
--region=REGION \
--boot-disk-type=DISK_TYPE \
--boot-disk-size=DISK_SIZE \
--scopes=cloud-platform \
--provisioning-model=STANDARD \
--maintenance-policy=TERMINATE \
--reservation-affinity=RESERVATION_AFFINITY
Completa los siguientes pasos:
-
Reemplaza lo siguiente:
NAME_PATTERN: Es el patrón de nombres que se usará para las instancias de N1 con GPU T4 o V100. Por ejemplo, si usasinstance-#para el patrón de nombre, se generan instancias de N1 con GPU T4 o V100 con nombres comoinstance-1yinstance-2, hasta la cantidad de instancias de N1 con GPU T4 o V100 especificadas por--count.COUNT: Es la cantidad de instancias de N1 con GPUs T4 o V100 que se crearán.MACHINE_TYPE: Es el tipo de máquina que se usará para la instancia de N1 con GPUs T4 o V100. Para obtener más información, consulta Tipos de máquinas con GPU en la documentación de Compute Engine.ACCELERATOR_COUNT: Es la cantidad de GPUs que deseas conectar a tu VM N1. Para obtener una lista de los límites de GPU en función del tipo de máquina de tu VM, consulta la información sobre las GPUs N1 en la documentación de Compute Engine.ACCELERATOR_TYPE: Es el tipo de acelerador para las VMs N1 que deseas usar. Para las cargas de trabajo de IA, te recomendamos que uses GPU T4 o V100.IMAGE_FAMILY: Es la familia de imágenes de la imagen de SO que deseas usar. Para obtener una lista de todos los sistemas operativos compatibles, consulta Sistemas operativos compatibles.IMAGE_PROJECT: Es el ID del proyecto de la imagen de SO.REGION: Especifica una región en la que esté disponible el tipo de máquina que deseas usar. Para obtener información sobre las regiones, consulta Disponibilidad de GPU por regiones y zonas.DISK_TYPE: El tipo de disco de arranque. Para obtener más información sobre los tipos de discos compatibles con tu tipo de máquina, consulta Máquinas con GPU en la familia de máquinas optimizadas para aceleradores en la documentación de Compute Engine.DISK_SIZE: Es el tamaño del disco de arranque en GB. Para obtener más información, consulta Límites de tamaño de Google Cloud Hyperdisk o Límites de tamaño de Persistent Disk, según el tipo de disco.RESERVATION_AFFINITY: Indica qué reservas puede consumir la instancia, si es posible. Especifica una de las siguientes opciones:any(la capacidad de reserva es opcional): Esta es la opción predeterminada. La instancia intenta usar capacidad de una reserva de consumo automático, lo que solo sucede si hay capacidad de reserva coincidente disponible. De lo contrario, la instancia usa capacidad a pedido.none(Se requiere capacidad según demanda): Bloquea la instancia para que no use ninguna capacidad de reserva.
De forma predeterminada, la instancia se reinicia automáticamente si falla o si Compute Engine la detiene por una detención programada, como un evento de mantenimiento. Si quieres inhabilitar el reinicio automático, agrega la siguiente marca:
--no-restart-on-failure
-
Opcional: Para conectar discos SSD locales, agrega la siguiente marca
--local-ssdpara cada disco SSD local.Asegúrate de que la cantidad de discos SSD locales que conectes esté permitida para tu tipo de máquina. Para obtener más detalles, consulta Acerca de los discos SSD locales en la documentación de Compute Engine.
--local-ssd interface=INTERFACE_TYPE
Reemplaza lo siguiente:
INTERFACE_TYPE: Es el tipo de interfaz de disco que deseas usar para el disco SSD local. Si tu imagen de disco de arranque tiene controladores NVMe optimizados, especificaNVME. EspecificaSCSIpara otras imágenes.
Después de crear una VM con discos SSD locales, debes formatear y activar cada dispositivo antes de poder usarlo.
- Ejecute el comando.
Spot
Antes de ejecutar el comando, revisa todos los pasos que se indican a continuación para determinar si debes incluir marcas adicionales.
gcloud compute instances bulk create \
--name-pattern=NAME_PATTERN \
--count=COUNT \
--machine-type=MACHINE_TYPE \
--accelerator=type=ACCELERATOR_TYPE,count=ACCELERATOR_COUNT \
--image-family=IMAGE_FAMILY \
--image-project=IMAGE_PROJECT \
--region=REGION \
--boot-disk-type=DISK_TYPE \
--boot-disk-size=DISK_SIZE \
--scopes=cloud-platform \
--provisioning-model=SPOT \
--instance-termination-action=TERMINATION_ACTION \
--maintenance-policy=TERMINATE \
--no-restart-on-failure
Completa los siguientes pasos:
-
Reemplaza lo siguiente:
NAME_PATTERN: Es el patrón de nombres que se usará para las instancias de N1 con GPU T4 o V100. Por ejemplo, si usasinstance-#para el patrón de nombre, se generan instancias de N1 con GPU T4 o V100 con nombres comoinstance-1yinstance-2, hasta la cantidad de instancias de N1 con GPU T4 o V100 especificadas por--count.COUNT: Es la cantidad de instancias de N1 con GPUs T4 o V100 que se crearán.MACHINE_TYPE: Es el tipo de máquina que se usará para la instancia de N1 con GPUs T4 o V100. Para obtener más información, consulta Tipos de máquinas con GPU en la documentación de Compute Engine.ACCELERATOR_COUNT: Es la cantidad de GPUs que deseas conectar a tu VM N1. Para obtener una lista de los límites de GPU en función del tipo de máquina de tu VM, consulta la información sobre las GPUs N1 en la documentación de Compute Engine.ACCELERATOR_TYPE: Es el tipo de acelerador para las VMs N1 que deseas usar. Para las cargas de trabajo de IA, te recomendamos que uses GPU T4 o V100.IMAGE_FAMILY: Es la familia de imágenes de la imagen de SO que deseas usar. Para obtener una lista de todos los sistemas operativos compatibles, consulta Sistemas operativos compatibles.IMAGE_PROJECT: Es el ID del proyecto de la imagen de SO.REGION: Especifica una región en la que esté disponible el tipo de máquina que deseas usar. Para obtener información sobre las regiones, consulta Disponibilidad de GPU por regiones y zonas.DISK_TYPE: El tipo de disco de arranque. Para obtener más información sobre los tipos de discos compatibles con tu tipo de máquina, consulta Máquinas con GPU en la familia de máquinas optimizadas para aceleradores en la documentación de Compute Engine.DISK_SIZE: Es el tamaño del disco de arranque en GB. Para obtener más información, consulta Límites de tamaño de Google Cloud Hyperdisk o Límites de tamaño de Persistent Disk, según el tipo de disco.TERMINATION_ACTION: Es la acción que se debe realizar cuando Compute Engine interrumpe la instancia, ya seaSTOP(predeterminada) oDELETE.
-
Opcional: Para conectar discos SSD locales, agrega la siguiente marca
--local-ssdpara cada disco SSD local.Asegúrate de que la cantidad de discos SSD locales que conectes esté permitida para tu tipo de máquina. Para obtener más detalles, consulta Acerca de los discos SSD locales en la documentación de Compute Engine.
--local-ssd interface=INTERFACE_TYPE
Reemplaza lo siguiente:
INTERFACE_TYPE: Es el tipo de interfaz de disco que deseas usar para el disco SSD local. Si tu imagen de disco de arranque tiene controladores NVMe optimizados, especificaNVME. EspecificaSCSIpara otras imágenes.
Después de crear una VM con discos SSD locales, debes formatear y activar cada dispositivo antes de poder usarlo.
- Ejecute el comando.
REST
Para crear instancias de forma masiva, realiza una solicitud POST al
método instances.bulkInsert.
Los parámetros que debes especificar dependen de la opción de consumo que uses para esta implementación. Selecciona la pestaña que corresponda a tu opción de consumo.
Reserva
Las instancias de N1 con GPU T4 o V100 admiten los siguientes tipos de reservas:
- Reservas según demanda
- Reservas futuras estándar
Para consumir estos tipos de reservas, una instancia debe usar el modelo de aprovisionamiento estándar. Por ejemplo, usa los siguientes parámetros de creación.
Antes de enviar la solicitud, revisa todos los pasos que se indican a continuación para determinar si debes incluir campos adicionales.
POST https://compute.googleapis.com/compute/v1/projects/PROJECT_ID/zones/ZONE/instances/bulkInsert
{
"namePattern": "NAME_PATTERN",
"count": "COUNT",
"instanceProperties": {
"machineType": "MACHINE_TYPE",
"guestAccelerators":
[
{
"acceleratorCount": ACCELERATOR_COUNT,
"acceleratorType": "projects/PROJECT_ID/zones/ZONE/acceleratorTypes/ACCELERATOR_TYPE"
}
],
"disks": [
{
"boot": true,
"initializeParams": {
"diskSizeGb": "DISK_SIZE",
"diskType": "DISK_TYPE",
"sourceImage": "projects/IMAGE_PROJECT/global/images/family/IMAGE_FAMILY"
},
"mode": "READ_WRITE",
"type": "PERSISTENT"
}
],
"serviceAccounts": [
{
"email": "default",
"scopes": [
"https://www.googleapis.com/auth/cloud-platform"
]
}
],
"scheduling": {
"provisioningModel": "STANDARD",
"onHostMaintenance": "TERMINATE",
"automaticRestart": AUTOMATIC_RESTART
},
"reservationAffinity": {
"consumeReservationType": "RESERVATION_AFFINITY",
"key": "compute.googleapis.com/reservation-name",
"values": [
"RESERVATION"
]
}
}
}
Completa los siguientes pasos:
-
Reemplaza lo siguiente:
PROJECT_ID: Es el ID del proyecto en el que deseas crear la instancia N1 con GPUs T4 o V100.ZONE: Especifica una zona en la que esté disponible el tipo de máquina que deseas usar. Para obtener información sobre las regiones, consulta Disponibilidad de GPU por regiones y zonas.NAME_PATTERN: Es el patrón de nombres que se usará para las instancias de N1 con GPU T4 o V100. Por ejemplo, si usasinstance-#para el patrón de nombre, se generan instancias de N1 con GPU T4 o V100 con nombres comoinstance-1yinstance-2, hasta la cantidad de instancias de N1 con GPU T4 o V100 especificadas por--count.COUNT: Es la cantidad de instancias de N1 con GPUs T4 o V100 que se crearán.MACHINE_TYPE: Es el tipo de máquina que se usará para la instancia de N1 con GPUs T4 o V100. Para obtener más información, consulta Tipos de máquinas con GPU en la documentación de Compute Engine.ACCELERATOR_COUNT: Es la cantidad de GPUs que deseas conectar a tu VM N1. Para obtener una lista de los límites de GPU en función del tipo de máquina de tu VM, consulta la información sobre las GPUs N1 en la documentación de Compute Engine.ACCELERATOR_TYPE: Es el tipo de acelerador para las VMs N1 que deseas usar. Para las cargas de trabajo de IA, te recomendamos que uses GPU T4 o V100.DISK_SIZE: Es el tamaño del disco de arranque en GB. Para obtener más información, consulta Límites de tamaño de Google Cloud Hyperdisk o Límites de tamaño de Persistent Disk, según el tipo de disco.DISK_TYPE: El tipo de disco de arranque. Para obtener más información sobre los tipos de discos compatibles con tu tipo de máquina, consulta Máquinas con GPU en la familia de máquinas optimizadas para aceleradores en la documentación de Compute Engine.IMAGE_PROJECT: Es el ID del proyecto de la imagen de SO.IMAGE_FAMILY: Es la familia de imágenes de la imagen de SO que deseas usar. Para obtener una lista de todos los sistemas operativos compatibles, consulta Sistemas operativos compatibles.AUTOMATIC_RESTART: Indica si la instancia se reinicia automáticamente si falla o si Compute Engine la detiene por una detención programada, como un evento de mantenimiento. Especificatruepara habilitar el reinicio automático (predeterminado) ofalsepara inhabilitarlo.RESERVATION_AFFINITY: Indica qué reservas puede consumir la instancia, si es posible. Especifica una de las siguientes opciones:ANY_RESERVATION(la capacidad de reserva es opcional): Esta es la opción predeterminada. La instancia intenta usar capacidad de una reserva que se consume automáticamente, lo que solo sucede si hay capacidad de reserva coincidente disponible. De lo contrario, la instancia usa capacidad a pedido.SPECIFIC_RESERVATION(Se requiere capacidad de reserva): Requiere que la instancia use capacidad de una reserva orientada específicamente. La instancia no puede usar la capacidad según demanda. Si la capacidad de reserva no está disponible, la creación de la instancia fallará.
RESERVATION: Es la reserva que se usará. Especifica una de las siguientes opciones según el valor que especificaste paraRESERVATION_AFFINITY:- Si especificaste
ANY_RESERVATION, borraRESERVATIONpara que el valor sea una cadena vacía (""). Como alternativa, puedes quitar por completo los camposkeyyvalues. Si especificaste
SPECIFIC_RESERVATION, reemplazaRESERVATIONpor lo siguiente:projects/RESERVATION_OWNER_PROJECT_ID/reservations/RESERVATION_NAME
Reemplaza lo siguiente:
RESERVATION_OWNER_PROJECT_ID: Es el ID del proyecto en el que se creó la reserva.RESERVATION_NAMEpor el nombre de la reserva.
- Si especificaste
-
Opcional: Para usar discos SSD locales, agrega el siguiente campo al campo
disks[]para cada disco SSD local. Separa cada subcampodisks[](incluido el disco de arranque) con una coma.Asegúrate de que la cantidad de discos SSD locales que conectes esté permitida para tu tipo de máquina. Para obtener más detalles, consulta Acerca de los discos SSD locales en la documentación de Compute Engine.
{ "type": "SCRATCH", "initializeParams": { "diskType": "zones/ZONE/diskTypes/local-ssd" }, "autoDelete": true, "interface": "INTERFACE_TYPE" }Reemplaza lo siguiente:
ZONE: La zona que especificaste.INTERFACE_TYPE: Es el tipo de interfaz de disco que deseas usar para el disco SSD local. Si tu imagen de disco de arranque tiene controladores NVMe optimizados, especificaNVME. EspecificaSCSIpara otras imágenes.
Después de crear una VM con discos SSD locales, debes formatear y activar cada dispositivo antes de poder usarlo.
- Envía la solicitud.
A pedido
Antes de enviar la solicitud, revisa todos los pasos que se indican a continuación para determinar si debes incluir campos adicionales.
POST https://compute.googleapis.com/compute/v1/projects/PROJECT_ID/zones/ZONE/instances/bulkInsert
{
"namePattern": "NAME_PATTERN",
"count": "COUNT",
"instanceProperties": {
"machineType": "MACHINE_TYPE",
"guestAccelerators":
[
{
"acceleratorCount": ACCELERATOR_COUNT,
"acceleratorType": "projects/PROJECT_ID/zones/ZONE/acceleratorTypes/ACCELERATOR_TYPE"
}
],
"disks": [
{
"boot": true,
"initializeParams": {
"diskSizeGb": "DISK_SIZE",
"diskType": "DISK_TYPE",
"sourceImage": "projects/IMAGE_PROJECT/global/images/family/IMAGE_FAMILY"
},
"mode": "READ_WRITE",
"type": "PERSISTENT"
}
],
"serviceAccounts": [
{
"email": "default",
"scopes": [
"https://www.googleapis.com/auth/cloud-platform"
]
}
],
"scheduling": {
"provisioningModel": "STANDARD",
"onHostMaintenance": "TERMINATE",
"automaticRestart": AUTOMATIC_RESTART
},
"reservationAffinity": {
"consumeReservationType": "RESERVATION_AFFINITY"
}
}
}
Completa los siguientes pasos:
-
Reemplaza lo siguiente:
PROJECT_ID: Es el ID del proyecto en el que deseas crear la instancia N1 con GPUs T4 o V100.ZONE: Especifica una zona en la que esté disponible el tipo de máquina que deseas usar. Para obtener información sobre las regiones, consulta Disponibilidad de GPU por regiones y zonas.NAME_PATTERN: Es el patrón de nombres que se usará para las instancias de N1 con GPU T4 o V100. Por ejemplo, si usasinstance-#para el patrón de nombre, se generan instancias de N1 con GPU T4 o V100 con nombres comoinstance-1yinstance-2, hasta la cantidad de instancias de N1 con GPU T4 o V100 especificadas por--count.COUNT: Es la cantidad de instancias de N1 con GPUs T4 o V100 que se crearán.MACHINE_TYPE: Es el tipo de máquina que se usará para la instancia de N1 con GPUs T4 o V100. Para obtener más información, consulta Tipos de máquinas con GPU en la documentación de Compute Engine.ACCELERATOR_COUNT: Es la cantidad de GPUs que deseas conectar a tu VM N1. Para obtener una lista de los límites de GPU en función del tipo de máquina de tu VM, consulta la información sobre las GPUs N1 en la documentación de Compute Engine.ACCELERATOR_TYPE: Es el tipo de acelerador para las VMs N1 que deseas usar. Para las cargas de trabajo de IA, te recomendamos que uses GPU T4 o V100.DISK_SIZE: Es el tamaño del disco de arranque en GB. Para obtener más información, consulta Límites de tamaño de Google Cloud Hyperdisk o Límites de tamaño de Persistent Disk, según el tipo de disco.DISK_TYPE: El tipo de disco de arranque. Para obtener más información sobre los tipos de discos compatibles con tu tipo de máquina, consulta Máquinas con GPU en la familia de máquinas optimizadas para aceleradores en la documentación de Compute Engine.IMAGE_PROJECT: Es el ID del proyecto de la imagen de SO.IMAGE_FAMILY: Es la familia de imágenes de la imagen de SO que deseas usar. Para obtener una lista de todos los sistemas operativos compatibles, consulta Sistemas operativos compatibles.AUTOMATIC_RESTART: Indica si la instancia se reinicia automáticamente si falla o si Compute Engine la detiene por una detención programada, como un evento de mantenimiento. Especificatruepara habilitar el reinicio automático (predeterminado) ofalsepara inhabilitarlo.RESERVATION_AFFINITY: Indica qué reservas puede consumir la instancia, si es posible. Especifica una de las siguientes opciones:ANY_RESERVATION(la capacidad de reserva es opcional): Esta es la opción predeterminada. La instancia intenta usar capacidad de una reserva que se consume automáticamente, lo que solo sucede si hay capacidad de reserva coincidente disponible. De lo contrario, la instancia usa capacidad a pedido.NO_RESERVATION(Se requiere capacidad según demanda): Bloquea la instancia para que no use ninguna capacidad de reserva.
-
Opcional: Para usar discos SSD locales, agrega el siguiente campo al campo
disks[]para cada disco SSD local. Separa cada subcampodisks[](incluido el disco de arranque) con una coma.Asegúrate de que la cantidad de discos SSD locales que conectes esté permitida para tu tipo de máquina. Para obtener más detalles, consulta Acerca de los discos SSD locales en la documentación de Compute Engine.
{ "type": "SCRATCH", "initializeParams": { "diskType": "zones/ZONE/diskTypes/local-ssd" }, "autoDelete": true, "interface": "INTERFACE_TYPE" }Reemplaza lo siguiente:
ZONE: La zona que especificaste.INTERFACE_TYPE: Es el tipo de interfaz de disco que deseas usar para el disco SSD local. Si tu imagen de disco de arranque tiene controladores NVMe optimizados, especificaNVME. EspecificaSCSIpara otras imágenes.
Después de crear una VM con discos SSD locales, debes formatear y activar cada dispositivo antes de poder usarlo.
- Envía la solicitud.
Spot
Antes de enviar la solicitud, revisa todos los pasos que se indican a continuación para determinar si debes incluir campos adicionales.
POST https://compute.googleapis.com/compute/v1/projects/PROJECT_ID/zones/ZONE/instances/bulkInsert
{
"namePattern": "NAME_PATTERN",
"count": "COUNT",
"instanceProperties": {
"machineType": "MACHINE_TYPE",
"guestAccelerators":
[
{
"acceleratorCount": ACCELERATOR_COUNT,
"acceleratorType": "projects/PROJECT_ID/zones/ZONE/acceleratorTypes/ACCELERATOR_TYPE"
}
],
"disks": [
{
"boot": true,
"initializeParams": {
"diskSizeGb": "DISK_SIZE",
"diskType": "DISK_TYPE",
"sourceImage": "projects/IMAGE_PROJECT/global/images/family/IMAGE_FAMILY"
},
"mode": "READ_WRITE",
"type": "PERSISTENT"
}
],
"serviceAccounts": [
{
"email": "default",
"scopes": [
"https://www.googleapis.com/auth/cloud-platform"
]
}
],
"scheduling":
{
"provisioningModel": "SPOT",
"instanceTerminationAction": "TERMINATION_ACTION",
"onHostMaintenance": "TERMINATE",
"automaticRestart": false
}
}
}
Completa los siguientes pasos:
-
Reemplaza lo siguiente:
PROJECT_ID: Es el ID del proyecto en el que deseas crear la instancia N1 con GPUs T4 o V100.ZONE: Especifica una zona en la que esté disponible el tipo de máquina que deseas usar. Para obtener información sobre las regiones, consulta Disponibilidad de GPU por regiones y zonas.NAME_PATTERN: Es el patrón de nombres que se usará para las instancias de N1 con GPU T4 o V100. Por ejemplo, si usasinstance-#para el patrón de nombre, se generan instancias de N1 con GPU T4 o V100 con nombres comoinstance-1yinstance-2, hasta la cantidad de instancias de N1 con GPU T4 o V100 especificadas por--count.COUNT: Es la cantidad de instancias de N1 con GPUs T4 o V100 que se crearán.MACHINE_TYPE: Es el tipo de máquina que se usará para la instancia de N1 con GPUs T4 o V100. Para obtener más información, consulta Tipos de máquinas con GPU en la documentación de Compute Engine.ACCELERATOR_COUNT: Es la cantidad de GPUs que deseas conectar a tu VM N1. Para obtener una lista de los límites de GPU en función del tipo de máquina de tu VM, consulta la información sobre las GPUs N1 en la documentación de Compute Engine.ACCELERATOR_TYPE: Es el tipo de acelerador para las VMs N1 que deseas usar. Para las cargas de trabajo de IA, te recomendamos que uses GPU T4 o V100.DISK_SIZE: Es el tamaño del disco de arranque en GB. Para obtener más información, consulta Límites de tamaño de Google Cloud Hyperdisk o Límites de tamaño de Persistent Disk, según el tipo de disco.DISK_TYPE: El tipo de disco de arranque. Para obtener más información sobre los tipos de discos compatibles con tu tipo de máquina, consulta Máquinas con GPU en la familia de máquinas optimizadas para aceleradores en la documentación de Compute Engine.IMAGE_PROJECT: Es el ID del proyecto de la imagen de SO.IMAGE_FAMILY: Es la familia de imágenes de la imagen de SO que deseas usar. Para obtener una lista de todos los sistemas operativos compatibles, consulta Sistemas operativos compatibles.TERMINATION_ACTION: Es la acción que se debe realizar cuando Compute Engine interrumpe la instancia, ya seaSTOP(predeterminada) oDELETE.
-
Opcional: Para usar discos SSD locales, agrega el siguiente campo al campo
disks[]para cada disco SSD local. Separa cada subcampodisks[](incluido el disco de arranque) con una coma.Asegúrate de que la cantidad de discos SSD locales que conectes esté permitida para tu tipo de máquina. Para obtener más detalles, consulta Acerca de los discos SSD locales en la documentación de Compute Engine.
{ "type": "SCRATCH", "initializeParams": { "diskType": "zones/ZONE/diskTypes/local-ssd" }, "autoDelete": true, "interface": "INTERFACE_TYPE" }Reemplaza lo siguiente:
ZONE: La zona que especificaste.INTERFACE_TYPE: Es el tipo de interfaz de disco que deseas usar para el disco SSD local. Si tu imagen de disco de arranque tiene controladores NVMe optimizados, especificaNVME. EspecificaSCSIpara otras imágenes.
Después de crear una VM con discos SSD locales, debes formatear y activar cada dispositivo antes de poder usarlo.
- Envía la solicitud.
Para obtener más información sobre las opciones de configuración cuando creas VMs de forma masiva, consulta Crea VMs de forma masiva en la documentación de Compute Engine.
Instalar los controladores de GPU.
Después de crear una instancia, esta no puede usar sus GPUs a menos que ya estén instalados los controladores de GPU correctos. El controlador que debes instalar depende de si la instancia habilitó la estación de trabajo virtual (vWS) NVIDIA RTX. Usa una de las siguientes opciones:
- Si habilitaste la vWS, consulta Instala controladores para estaciones de trabajo virtuales (vWS) de NVIDIA RTX en la documentación de Compute Engine.
De lo contrario, usa los controladores de GPU predeterminados de la siguiente manera:
- Si especificaste una imagen de SO que incluye controladores de GPU, no es necesario que realices ninguna acción.
- Si la imagen de SO no incluye controladores de GPU, consulta Cómo instalar controladores de GPU en la documentación de Compute Engine.
¿Qué sigue?
- Consulta los detalles de una VM
- Obtén una lista de las VM
- Verifica el consumo de la reserva
- Soluciona problemas de consumo de reservas)