En este documento, se explica cómo crear instancias de máquina virtual (VM) de forma masiva que usen la serie A2, que incluye los tipos de máquinas A2 Ultra o A2 estándar. Para obtener más información sobre estos tipos de máquinas optimizados para aceleradores, consulta la serie A2.
Para obtener más información sobre cómo crear VMs de forma masiva, consulta Acerca de la creación masiva de VMs en la documentación de Compute Engine.
Para obtener información sobre otras formas de crear VMs o clústeres, consulta la Descripción general de las opciones de implementación.
Limitaciones
Cuando creas VMs A2 Ultra o A2 estándar de forma masiva, se aplican las siguientes limitaciones:
A2 ultra
- No recibirás descuentos por uso continuo ni descuentos por compromiso de uso flexible para las instancias que usan un tipo de máquina A2 ultra.
- Solo puedes usar un tipo de máquina A2 ultra en ciertas regiones y zonas.
- Los tipos de máquinas A2 ultra solo están disponibles en la plataforma Cascade Lake.
- Si tu instancia usa un tipo de máquina A2 ultra, no puedes cambiar el tipo de máquina. Si necesitas usar un tipo de máquina A2 ultra diferente o cualquier otro tipo de máquina, debes crear una instancia nueva.
- No puedes cambiar ningún otro tipo de máquina a uno A2 ultra. Si necesitas una instancia que use un tipo de máquina A2 ultra, debes crear una instancia nueva.
- No puedes realizar un formateo rápido de las SSD locales conectados en las instancias de Windows que usan los tipos de máquinas A2 ultra. Para formatear estos SSD locales, debes realizar un formateo completo mediante el uso de la utilidad diskpart y la especificación de
format fs=ntfs label=tmpfs.
A2 Estándar
- No recibirás descuentos por uso continuo ni descuentos por compromiso de uso flexible para las instancias que usan un tipo de máquina A2 estándar.
- Solo puedes usar un tipo de máquina A2 estándar en ciertas regiones y zonas.
- Los tipos de máquinas A2 estándar solo están disponibles en la plataforma Cascade Lake.
- Si tu instancia usa un tipo de máquina estándar A2, solo puedes cambiar de un tipo de máquina estándar A2 a otro. No puedes cambiar a ningún otro tipo de máquina. Para obtener más información, consulta Cómo modificar instancias optimizadas para aceleradores.
- No puedes usar el sistema operativo Windows con el tipo de máquina
a2-megagpu-16g. Cuando uses un sistema operativo Windows, elige un tipo de máquina A2 estándar diferente. - No puedes realizar un formateo rápido de las SSD locales conectadas en las instancias de Windows que usan los tipos de máquinas A2 estándar.
Para formatear estos SSD locales, debes realizar un formateo completo mediante el uso de la utilidad diskpart y la especificación de
format fs=ntfs label=tmpfs.
Antes de comenzar
Antes de crear VMs de forma masiva, si aún no lo hiciste, completa los siguientes pasos:
- Elige una opción de consumo: La opción de consumo que elijas determinará cómo obtendrás y usarás los recursos de GPU. Para obtener más información, consulta Elige una opción de consumo.
- Obtén capacidad: El proceso para obtener capacidad difiere para cada opción de consumo. Para obtener información sobre el proceso para obtener capacidad para la opción de consumo que elegiste, consulta Descripción general de la capacidad.
Selecciona la pestaña que corresponda a la forma en que planeas usar las muestras de esta página:
Console
Cuando usas la consola de Google Cloud para acceder a los servicios y las APIs de Google Cloud , no necesitas configurar la autenticación.
gcloud
En la consola de Google Cloud , activa Cloud Shell.
En la parte inferior de la consola de Google Cloud , se inicia una sesión de Cloud Shell en la que se muestra una ventana de línea de comandos. Cloud Shell es un entorno de shell con Google Cloud CLI ya instalada y con valores ya establecidos para el proyecto actual. La sesión puede tardar unos segundos en inicializarse.
REST
Para usar las muestras de la API de REST incluidas en esta página en un entorno de desarrollo local, debes usar las credenciales que proporciones a la gcloud CLI.
Instala Google Cloud CLI.
Si usas un proveedor de identidad externo (IdP), primero debes acceder a la gcloud CLI con tu identidad federada.
Para obtener más información, consulta Autentícate para usar REST en la documentación de autenticación de Google Cloud .
Roles obligatorios
Para obtener los permisos que necesitas
para crear VMs de forma masiva,
pídele a tu administrador que te otorgue el rol de IAM
Administrador de instancias de Compute (v1) (roles/compute.instanceAdmin.v1) en el proyecto.
Para obtener más información sobre cómo otorgar roles, consulta Administra el acceso a proyectos, carpetas y organizaciones.
Este rol predefinido contiene los permisos necesarios para crear VMs de forma masiva. Para ver los permisos exactos que son necesarios, expande la sección Permisos requeridos:
Permisos necesarios
Se requieren los siguientes permisos para crear VMs de forma masiva:
-
compute.instances.createen el proyecto -
Si deseas usar una imagen personalizada para crear la VM, sigue estos pasos:
compute.images.useReadOnlyen la imagen -
Para usar una instantánea a fin de crear la VM, haz lo siguiente:
compute.snapshots.useReadOnlyen la instantánea -
Si quieres usar una plantilla de instancias para crear la VM, sigue estos pasos:
compute.instanceTemplates.useReadOnlyen la plantilla de instancias -
A fin de especificar una subred para tu VM:
compute.subnetworks.useen el proyecto o en la subred elegida -
Si deseas especificar una dirección IP estática para la VM:
compute.addresses.useen el proyecto -
Para asignar una dirección IP externa a la VM cuando se usa una red de VPC,
compute.subnetworks.useExternalIpen el proyecto o en la subred elegida. -
Para asignar una red heredada a la VM, ejecuta
compute.networks.useen el proyecto. -
Para asignar una dirección IP externa a la VM cuando se usa una red heredada, ejecuta
compute.networks.useExternalIpen el proyecto -
Para configurar los metadatos de la instancia de VM para la VM,
compute.instances.setMetadataen el proyecto. -
Para configurar etiquetas en la VM, haz lo siguiente:
compute.instances.setTagsen la VM -
Para configurar etiquetas en la VM, haz lo siguiente:
compute.instances.setLabelsen la VM -
A fin de configurar una cuenta de servicio para que la VM use:
compute.instances.setServiceAccounten la VM -
Crear un disco nuevo para la VM:
compute.disks.createen el proyecto -
Para conectar un disco existente en modo de solo lectura o de lectura y escritura, usa
compute.disks.useen el disco. -
Para conectar un disco existente en modo de solo lectura, haz lo siguiente:
compute.disks.useReadOnlyen el disco
También puedes obtener estos permisos con roles personalizados o con otros roles predefinidos.
Descripción general
La creación masiva de instancias con el tipo de máquina A2 incluye los siguientes pasos:
- Opcional: Crea una política de posición compacta
- Crea instancias de forma masiva
- Instala controladores de GPU
- Opcional: Habilita el modo de GPU de varias instancias de NVIDIA
Opcional: Crea una política de posición compacta
Puedes especificar la posición de la VM creando una política de posición compacta. Cuando aplicas una política de posición compacta a tus VMs, Compute Engine hace su mejor esfuerzo para crear VMs que estén lo más cerca posible entre sí. Si tu aplicación es sensible a la latencia y requiere la máxima compactación, especifica el campo maxDistance (versión preliminar) cuando crees una política de posición compacta. Un valor de maxDistance más bajo garantiza una colocación más cercana de las VM, pero también aumenta la probabilidad de que no se creen algunas VMs.
gcloud
Para crear una política de posición compacta, usa el
comando gcloud beta compute resource-policies create group-placement:
gcloud beta compute resource-policies create group-placement POLICY_NAME \
--collocation=collocated \
--max-distance=MAX_DISTANCE \
--region=REGION
Reemplaza lo siguiente:
POLICY_NAME: el nombre de la política de posición compacta.MAX_DISTANCE: Es la configuración de distancia máxima para tus VMs, que se puede especificar (vista previa, recomendado) o no especificar (quita la marca--max-distance). Asegúrate de que la configuración de distancia máxima admita la serie de máquinas y la cantidad de VMs que planeas crear. Para obtener más información, consulta Acerca de las políticas de posición compacta en la documentación de Compute Engine. Por ejemplo, una distancia máxima de3coloca las VMs en bloques adyacentes y2coloca las VMs en el mismo bloque.REGION: la región en la que deseas crear la política de posición compacta. Especifica la región que contiene la zona en la que planeas crear instancias y verifica que el tipo de máquina que deseas usar esté disponible en esa región. Para obtener información sobre las regiones, consulta Disponibilidad de GPU por regiones y zonas.
REST
Para crear una política de posición compacta, realiza una solicitud POST al
método resourcePolicies.insert de la versión beta.
En el cuerpo de la solicitud, incluye el campo collocation configurado como COLLOCATED y el campo maxDistance.
POST https://compute.googleapis.com/compute/beta/projects/PROJECT_ID/regions/REGION/resourcePolicies
{
"name": "POLICY_NAME",
"groupPlacementPolicy": {
"collocation": "COLLOCATED",
"maxDistance": MAX_DISTANCE
}
}
Reemplaza lo siguiente:
PROJECT_ID: el ID de tu proyectoPOLICY_NAME: el nombre de la política de posición compacta.MAX_DISTANCE: Es la configuración de distancia máxima para tus VMs, que se puede especificar (vista previa, recomendada) o no especificar (quitar el campomaxDistance). Asegúrate de que la configuración de distancia máxima admita la serie de máquinas y la cantidad de VMs que planeas crear. Para obtener más información, consulta Acerca de las políticas de posición compacta en la documentación de Compute Engine. Por ejemplo, una distancia máxima de3coloca las VMs en bloques adyacentes y2coloca las VMs en el mismo bloque.REGION: la región en la que deseas crear la política de posición compacta. Especifica la región que contiene la zona en la que planeas crear instancias y verifica que el tipo de máquina que deseas usar esté disponible en esa región. Para obtener información sobre las regiones, consulta Disponibilidad de GPU por regiones y zonas.
Crea VMs de A2 de forma masiva
Para crear una VM A2, usa uno de los siguientes métodos.
Los siguientes comandos también establecen el permiso de acceso para tus instancias. Para simplificar la administración de permisos, Google recomienda que configures el permiso de acceso en una instancia como accesocloud-platform y, luego, uses roles de IAM para definir a qué servicios puede acceder la instancia. Para obtener más información, consulta las prácticas recomendadas para los permisos.
gcloud
Para crear instancias de forma masiva, usa el
comando gcloud compute instances bulk create.
Los parámetros que debes especificar dependen de la opción de consumo que uses para esta implementación. Selecciona la pestaña que corresponda a tu opción de consumo.
Reserva
Las instancias de A2 admiten los siguientes tipos de reservas:
- Reservas según demanda
- Reservas futuras estándar
Para consumir estos tipos de reservas, una instancia debe usar el modelo de aprovisionamiento estándar. Por ejemplo, usa los siguientes parámetros de creación.
Antes de ejecutar el comando, revisa todos los pasos que se indican a continuación para determinar si debes incluir marcas adicionales.
gcloud compute instances bulk create \
--name-pattern=NAME_PATTERN \
--count=COUNT \
--machine-type=MACHINE_TYPE \
--image-family=IMAGE_FAMILY \
--image-project=IMAGE_PROJECT \
--region=REGION \
--boot-disk-type=DISK_TYPE \
--boot-disk-size=DISK_SIZE \
--scopes=cloud-platform \
--provisioning-model=STANDARD \
--maintenance-policy=TERMINATE \
--reservation-affinity=RESERVATION_AFFINITY \
--reservation=RESERVATION
Completa los siguientes pasos:
-
Reemplaza lo siguiente:
NAME_PATTERN: Es el patrón de nombres que se usará para las instancias de A2. Por ejemplo, si usasinstance-#para el patrón de nombre, se generan instancias A2 con nombres comoinstance-1yinstance-2, hasta la cantidad de instancias A2 especificadas por--count.COUNT: Es la cantidad de instancias de A2 que se crearán.MACHINE_TYPE: Es el tipo de máquina que se usará para la instancia A2. Para obtener más información, consulta Tipos de máquinas con GPU en la documentación de Compute Engine.IMAGE_FAMILY: Es la familia de imágenes de la imagen de SO que deseas usar. Para obtener una lista de todos los sistemas operativos compatibles, consulta Sistemas operativos compatibles.IMAGE_PROJECT: Es el ID del proyecto de la imagen de SO.REGION: Especifica una región en la que esté disponible el tipo de máquina que deseas usar. Si deseas especificar una política de posición compacta, debes usar la misma región que la política de posición compacta. Para obtener información sobre las regiones, consulta Disponibilidad de GPU por regiones y zonas.DISK_TYPE: El tipo de disco de arranque. Para obtener más información sobre los tipos de discos compatibles con tu tipo de máquina, consulta Máquinas con GPU en la familia de máquinas optimizadas para aceleradores en la documentación de Compute Engine.DISK_SIZE: Es el tamaño del disco de arranque en GB. Para obtener más información, consulta Límites de tamaño de Google Cloud Hyperdisk o Límites de tamaño de Persistent Disk, según el tipo de disco.RESERVATION_AFFINITY: Indica qué reservas puede consumir la instancia, si es posible. Especifica una de las siguientes opciones:any(la capacidad de reserva es opcional): Esta es la opción predeterminada. La instancia intenta usar capacidad de una reserva de consumo automático, lo que solo sucede si hay capacidad de reserva coincidente disponible. De lo contrario, la instancia usa capacidad a pedido.specific(Se requiere capacidad de reserva): Requiere que la instancia use capacidad de una reserva orientada específicamente. La instancia no puede usar la capacidad según demanda. Si la capacidad de reserva no está disponible, la creación de la instancia fallará.
RESERVATION: Es la reserva que se usará. Especifica una de las siguientes opciones según el valor que especificaste paraRESERVATION_AFFINITY:- Si especificaste
any, reemplazaRESERVATIONpor una cadena vacía (""). Como alternativa, puedes quitar la marca--reservationpor completo. Si especificaste
specific, reemplazaRESERVATIONpor lo siguiente:projects/RESERVATION_OWNER_PROJECT_ID/reservations/RESERVATION_NAME
Reemplaza lo siguiente:
RESERVATION_OWNER_PROJECT_ID: Es el ID del proyecto en el que se creó la reserva.RESERVATION_NAMEpor el nombre de la reserva.
- Si especificaste
De forma predeterminada, la instancia se reinicia automáticamente si falla o si Compute Engine la detiene por una detención programada, como un evento de mantenimiento. Si quieres inhabilitar el reinicio automático, agrega la siguiente marca:
--no-restart-on-failure
-
Opcional: Si elegiste usar una política de posición compacta, agrega la siguiente marca al comando:
--resource-policies=POLICY_NAME
Reemplaza lo siguiente:
POLICY_NAME: el nombre de la política de posición compacta.
-
Opcional: Si especificaste un tipo de máquina A2 estándar y deseas conectar discos SSD locales, agrega la siguiente marca
--local-ssdpara cada disco SSD local.Asegúrate de que la cantidad de discos SSD locales que conectes esté permitida para tu tipo de máquina. Para obtener más detalles, consulta Acerca de los discos SSD locales en la documentación de Compute Engine.
--local-ssd interface=INTERFACE_TYPE
Reemplaza lo siguiente:
INTERFACE_TYPE: Es el tipo de interfaz de disco que deseas usar para el disco SSD local. Si tu imagen de disco de arranque tiene controladores NVMe optimizados, especificaNVME. EspecificaSCSIpara otras imágenes.
Después de crear una VM con discos SSD locales, debes formatear y activar cada dispositivo antes de poder usarlo.
- Ejecute el comando.
A pedido
Antes de ejecutar el comando, revisa todos los pasos que se indican a continuación para determinar si debes incluir marcas adicionales.
gcloud compute instances bulk create \
--name-pattern=NAME_PATTERN \
--count=COUNT \
--machine-type=MACHINE_TYPE \
--image-family=IMAGE_FAMILY \
--image-project=IMAGE_PROJECT \
--region=REGION \
--boot-disk-type=DISK_TYPE \
--boot-disk-size=DISK_SIZE \
--scopes=cloud-platform \
--provisioning-model=STANDARD \
--maintenance-policy=TERMINATE \
--reservation-affinity=RESERVATION_AFFINITY
Completa los siguientes pasos:
-
Reemplaza lo siguiente:
NAME_PATTERN: Es el patrón de nombres que se usará para las instancias de A2. Por ejemplo, si usasinstance-#para el patrón de nombre, se generan instancias A2 con nombres comoinstance-1yinstance-2, hasta la cantidad de instancias A2 especificadas por--count.COUNT: Es la cantidad de instancias de A2 que se crearán.MACHINE_TYPE: Es el tipo de máquina que se usará para la instancia A2. Para obtener más información, consulta Tipos de máquinas con GPU en la documentación de Compute Engine.IMAGE_FAMILY: Es la familia de imágenes de la imagen de SO que deseas usar. Para obtener una lista de todos los sistemas operativos compatibles, consulta Sistemas operativos compatibles.IMAGE_PROJECT: Es el ID del proyecto de la imagen de SO.REGION: Especifica una región en la que esté disponible el tipo de máquina que deseas usar. Si deseas especificar una política de posición compacta, debes usar la misma región que la política de posición compacta. Para obtener información sobre las regiones, consulta Disponibilidad de GPU por regiones y zonas.DISK_TYPE: El tipo de disco de arranque. Para obtener más información sobre los tipos de discos compatibles con tu tipo de máquina, consulta Máquinas con GPU en la familia de máquinas optimizadas para aceleradores en la documentación de Compute Engine.DISK_SIZE: Es el tamaño del disco de arranque en GB. Para obtener más información, consulta Límites de tamaño de Google Cloud Hyperdisk o Límites de tamaño de Persistent Disk, según el tipo de disco.RESERVATION_AFFINITY: Indica qué reservas puede consumir la instancia, si es posible. Especifica una de las siguientes opciones:any(la capacidad de reserva es opcional): Esta es la opción predeterminada. La instancia intenta usar capacidad de una reserva de consumo automático, lo que solo sucede si hay capacidad de reserva coincidente disponible. De lo contrario, la instancia usa capacidad a pedido.none(Se requiere capacidad según demanda): Bloquea la instancia para que no use ninguna capacidad de reserva.
De forma predeterminada, la instancia se reinicia automáticamente si falla o si Compute Engine la detiene por una detención programada, como un evento de mantenimiento. Si quieres inhabilitar el reinicio automático, agrega la siguiente marca:
--no-restart-on-failure
-
Opcional: Si elegiste usar una política de posición compacta, agrega la siguiente marca al comando:
--resource-policies=POLICY_NAME
Reemplaza lo siguiente:
POLICY_NAME: el nombre de la política de posición compacta.
-
Opcional: Si especificaste un tipo de máquina A2 estándar y deseas conectar discos SSD locales, agrega la siguiente marca
--local-ssdpara cada disco SSD local.Asegúrate de que la cantidad de discos SSD locales que conectes esté permitida para tu tipo de máquina. Para obtener más detalles, consulta Acerca de los discos SSD locales en la documentación de Compute Engine.
--local-ssd interface=INTERFACE_TYPE
Reemplaza lo siguiente:
INTERFACE_TYPE: Es el tipo de interfaz de disco que deseas usar para el disco SSD local. Si tu imagen de disco de arranque tiene controladores NVMe optimizados, especificaNVME. EspecificaSCSIpara otras imágenes.
Después de crear una VM con discos SSD locales, debes formatear y activar cada dispositivo antes de poder usarlo.
- Ejecute el comando.
Spot
Antes de ejecutar el comando, revisa todos los pasos que se indican a continuación para determinar si debes incluir marcas adicionales.
gcloud compute instances bulk create \
--name-pattern=NAME_PATTERN \
--count=COUNT \
--machine-type=MACHINE_TYPE \
--image-family=IMAGE_FAMILY \
--image-project=IMAGE_PROJECT \
--region=REGION \
--boot-disk-type=DISK_TYPE \
--boot-disk-size=DISK_SIZE \
--scopes=cloud-platform \
--provisioning-model=SPOT \
--instance-termination-action=TERMINATION_ACTION \
--maintenance-policy=TERMINATE \
--no-restart-on-failure
Completa los siguientes pasos:
-
Reemplaza lo siguiente:
NAME_PATTERN: Es el patrón de nombres que se usará para las instancias de A2. Por ejemplo, si usasinstance-#para el patrón de nombre, se generan instancias A2 con nombres comoinstance-1yinstance-2, hasta la cantidad de instancias A2 especificadas por--count.COUNT: Es la cantidad de instancias de A2 que se crearán.MACHINE_TYPE: Es el tipo de máquina que se usará para la instancia A2. Para obtener más información, consulta Tipos de máquinas con GPU en la documentación de Compute Engine.IMAGE_FAMILY: Es la familia de imágenes de la imagen de SO que deseas usar. Para obtener una lista de todos los sistemas operativos compatibles, consulta Sistemas operativos compatibles.IMAGE_PROJECT: Es el ID del proyecto de la imagen de SO.REGION: Especifica una región en la que esté disponible el tipo de máquina que deseas usar. Si deseas especificar una política de posición compacta, debes usar la misma región que la política de posición compacta. Para obtener información sobre las regiones, consulta Disponibilidad de GPU por regiones y zonas.DISK_TYPE: El tipo de disco de arranque. Para obtener más información sobre los tipos de discos compatibles con tu tipo de máquina, consulta Máquinas con GPU en la familia de máquinas optimizadas para aceleradores en la documentación de Compute Engine.DISK_SIZE: Es el tamaño del disco de arranque en GB. Para obtener más información, consulta Límites de tamaño de Google Cloud Hyperdisk o Límites de tamaño de Persistent Disk, según el tipo de disco.TERMINATION_ACTION: Es la acción que se debe realizar cuando Compute Engine interrumpe la instancia, ya seaSTOP(predeterminada) oDELETE.
-
Opcional: Si elegiste usar una política de posición compacta, agrega la siguiente marca al comando:
--resource-policies=POLICY_NAME
Reemplaza lo siguiente:
POLICY_NAME: el nombre de la política de posición compacta.
-
Opcional: Si especificaste un tipo de máquina A2 estándar y deseas conectar discos SSD locales, agrega la siguiente marca
--local-ssdpara cada disco SSD local.Asegúrate de que la cantidad de discos SSD locales que conectes esté permitida para tu tipo de máquina. Para obtener más detalles, consulta Acerca de los discos SSD locales en la documentación de Compute Engine.
--local-ssd interface=INTERFACE_TYPE
Reemplaza lo siguiente:
INTERFACE_TYPE: Es el tipo de interfaz de disco que deseas usar para el disco SSD local. Si tu imagen de disco de arranque tiene controladores NVMe optimizados, especificaNVME. EspecificaSCSIpara otras imágenes.
Después de crear una VM con discos SSD locales, debes formatear y activar cada dispositivo antes de poder usarlo.
- Ejecute el comando.
REST
Para crear instancias de forma masiva, realiza una solicitud POST al
método instances.bulkInsert.
Los parámetros que debes especificar dependen de la opción de consumo que uses para esta implementación. Selecciona la pestaña que corresponda a tu opción de consumo.
Reserva
Las instancias de A2 admiten los siguientes tipos de reservas:
- Reservas según demanda
- Reservas futuras estándar
Para consumir estos tipos de reservas, una instancia debe usar el modelo de aprovisionamiento estándar. Por ejemplo, usa los siguientes parámetros de creación.
Antes de enviar la solicitud, revisa todos los pasos que se indican a continuación para determinar si debes incluir campos adicionales.
POST https://compute.googleapis.com/compute/v1/projects/PROJECT_ID/zones/ZONE/instances/bulkInsert
{
"namePattern": "NAME_PATTERN",
"count": "COUNT",
"instanceProperties": {
"machineType": "MACHINE_TYPE",
"disks": [
{
"boot": true,
"initializeParams": {
"diskSizeGb": "DISK_SIZE",
"diskType": "DISK_TYPE",
"sourceImage": "projects/IMAGE_PROJECT/global/images/family/IMAGE_FAMILY"
},
"mode": "READ_WRITE",
"type": "PERSISTENT"
}
],
"serviceAccounts": [
{
"email": "default",
"scopes": [
"https://www.googleapis.com/auth/cloud-platform"
]
}
],
"scheduling": {
"provisioningModel": "STANDARD",
"onHostMaintenance": "TERMINATE",
"automaticRestart": AUTOMATIC_RESTART
},
"reservationAffinity": {
"consumeReservationType": "RESERVATION_AFFINITY",
"key": "compute.googleapis.com/reservation-name",
"values": [
"RESERVATION"
]
}
}
}
Completa los siguientes pasos:
-
Reemplaza lo siguiente:
PROJECT_ID: ID del proyecto en el que deseas crear la instancia A2.ZONE: Especifica una zona en la que esté disponible el tipo de máquina que deseas usar. Si deseas especificar una política de posición compacta, debes usar una zona en la misma región que la política de posición compacta. Para obtener información sobre las regiones, consulta Disponibilidad de GPU por regiones y zonas.NAME_PATTERN: Es el patrón de nombres que se usará para las instancias de A2. Por ejemplo, si usasinstance-#para el patrón de nombre, se generan instancias A2 con nombres comoinstance-1yinstance-2, hasta la cantidad de instancias A2 especificadas por--count.COUNT: Es la cantidad de instancias de A2 que se crearán.MACHINE_TYPE: Es el tipo de máquina que se usará para la instancia A2. Para obtener más información, consulta Tipos de máquinas con GPU en la documentación de Compute Engine.DISK_SIZE: Es el tamaño del disco de arranque en GB. Para obtener más información, consulta Límites de tamaño de Google Cloud Hyperdisk o Límites de tamaño de Persistent Disk, según el tipo de disco.DISK_TYPE: El tipo de disco de arranque. Para obtener más información sobre los tipos de discos compatibles con tu tipo de máquina, consulta Máquinas con GPU en la familia de máquinas optimizadas para aceleradores en la documentación de Compute Engine.IMAGE_PROJECT: Es el ID del proyecto de la imagen de SO.IMAGE_FAMILY: Es la familia de imágenes de la imagen de SO que deseas usar. Para obtener una lista de todos los sistemas operativos compatibles, consulta Sistemas operativos compatibles.AUTOMATIC_RESTART: Indica si la instancia se reinicia automáticamente si falla o si Compute Engine la detiene por una detención programada, como un evento de mantenimiento. Especificatruepara habilitar el reinicio automático (predeterminado) ofalsepara inhabilitarlo.RESERVATION_AFFINITY: Indica qué reservas puede consumir la instancia, si es posible. Especifica una de las siguientes opciones:ANY_RESERVATION(la capacidad de reserva es opcional): Esta es la opción predeterminada. La instancia intenta usar capacidad de una reserva que se consume automáticamente, lo que solo sucede si hay capacidad de reserva coincidente disponible. De lo contrario, la instancia usa capacidad a pedido.SPECIFIC_RESERVATION(Se requiere capacidad de reserva): Requiere que la instancia use capacidad de una reserva orientada específicamente. La instancia no puede usar la capacidad según demanda. Si la capacidad de reserva no está disponible, la creación de la instancia fallará.
RESERVATION: Es la reserva que se usará. Especifica una de las siguientes opciones según el valor que especificaste paraRESERVATION_AFFINITY:- Si especificaste
ANY_RESERVATION, borraRESERVATIONpara que el valor sea una cadena vacía (""). Como alternativa, puedes quitar por completo los camposkeyyvalues. Si especificaste
SPECIFIC_RESERVATION, reemplazaRESERVATIONpor lo siguiente:projects/RESERVATION_OWNER_PROJECT_ID/reservations/RESERVATION_NAME
Reemplaza lo siguiente:
RESERVATION_OWNER_PROJECT_ID: Es el ID del proyecto en el que se creó la reserva.RESERVATION_NAMEpor el nombre de la reserva.
- Si especificaste
-
Opcional: Si elegiste usar una política de posición compacta, agrega el siguiente subcampo
instancePropertiesal cuerpo de la solicitud:"resourcePolicies": [ "projects/PROJECT_ID/regions/REGION/resourcePolicies/POLICY_NAME" ]Reemplaza lo siguiente:
PROJECT_ID: Es el ID del proyecto de la política de posición compacta.REGION: Es la región de la política de posición compacta.POLICY_NAME: el nombre de la política de posición compacta.
-
Opcional: Si especificaste un tipo de máquina A2 estándar y deseas conectar discos SSD locales, agrega el siguiente campo al campo
disks[]para cada disco SSD local. Separa cada subcampodisks[](incluido el disco de arranque) con una coma.Asegúrate de que la cantidad de discos SSD locales que conectes esté permitida para tu tipo de máquina. Para obtener más detalles, consulta Acerca de los discos SSD locales en la documentación de Compute Engine.
{ "type": "SCRATCH", "initializeParams": { "diskType": "zones/ZONE/diskTypes/local-ssd" }, "autoDelete": true, "interface": "INTERFACE_TYPE" }Reemplaza lo siguiente:
ZONE: La zona que especificaste.INTERFACE_TYPE: Es el tipo de interfaz de disco que deseas usar para el disco SSD local. Si tu imagen de disco de arranque tiene controladores NVMe optimizados, especificaNVME. EspecificaSCSIpara otras imágenes.
Después de crear una VM con discos SSD locales, debes formatear y activar cada dispositivo antes de poder usarlo.
- Envía la solicitud.
A pedido
Antes de enviar la solicitud, revisa todos los pasos que se indican a continuación para determinar si debes incluir campos adicionales.
POST https://compute.googleapis.com/compute/v1/projects/PROJECT_ID/zones/ZONE/instances/bulkInsert
{
"namePattern": "NAME_PATTERN",
"count": "COUNT",
"instanceProperties": {
"machineType": "MACHINE_TYPE",
"disks": [
{
"boot": true,
"initializeParams": {
"diskSizeGb": "DISK_SIZE",
"diskType": "DISK_TYPE",
"sourceImage": "projects/IMAGE_PROJECT/global/images/family/IMAGE_FAMILY"
},
"mode": "READ_WRITE",
"type": "PERSISTENT"
}
],
"serviceAccounts": [
{
"email": "default",
"scopes": [
"https://www.googleapis.com/auth/cloud-platform"
]
}
],
"scheduling": {
"provisioningModel": "STANDARD",
"onHostMaintenance": "TERMINATE",
"automaticRestart": AUTOMATIC_RESTART
},
"reservationAffinity": {
"consumeReservationType": "RESERVATION_AFFINITY"
}
}
}
Completa los siguientes pasos:
-
Reemplaza lo siguiente:
PROJECT_ID: ID del proyecto en el que deseas crear la instancia A2.ZONE: Especifica una zona en la que esté disponible el tipo de máquina que deseas usar. Si deseas especificar una política de posición compacta, debes usar una zona en la misma región que la política de posición compacta. Para obtener información sobre las regiones, consulta Disponibilidad de GPU por regiones y zonas.NAME_PATTERN: Es el patrón de nombres que se usará para las instancias de A2. Por ejemplo, si usasinstance-#para el patrón de nombre, se generan instancias A2 con nombres comoinstance-1yinstance-2, hasta la cantidad de instancias A2 especificadas por--count.COUNT: Es la cantidad de instancias de A2 que se crearán.MACHINE_TYPE: Es el tipo de máquina que se usará para la instancia A2. Para obtener más información, consulta Tipos de máquinas con GPU en la documentación de Compute Engine.DISK_SIZE: Es el tamaño del disco de arranque en GB. Para obtener más información, consulta Límites de tamaño de Google Cloud Hyperdisk o Límites de tamaño de Persistent Disk, según el tipo de disco.DISK_TYPE: El tipo de disco de arranque. Para obtener más información sobre los tipos de discos compatibles con tu tipo de máquina, consulta Máquinas con GPU en la familia de máquinas optimizadas para aceleradores en la documentación de Compute Engine.IMAGE_PROJECT: Es el ID del proyecto de la imagen de SO.IMAGE_FAMILY: Es la familia de imágenes de la imagen de SO que deseas usar. Para obtener una lista de todos los sistemas operativos compatibles, consulta Sistemas operativos compatibles.AUTOMATIC_RESTART: Indica si la instancia se reinicia automáticamente si falla o si Compute Engine la detiene por una detención programada, como un evento de mantenimiento. Especificatruepara habilitar el reinicio automático (predeterminado) ofalsepara inhabilitarlo.RESERVATION_AFFINITY: Indica qué reservas puede consumir la instancia, si es posible. Especifica una de las siguientes opciones:ANY_RESERVATION(la capacidad de reserva es opcional): Esta es la opción predeterminada. La instancia intenta usar capacidad de una reserva que se consume automáticamente, lo que solo sucede si hay capacidad de reserva coincidente disponible. De lo contrario, la instancia usa capacidad a pedido.NO_RESERVATION(Se requiere capacidad según demanda): Bloquea la instancia para que no use ninguna capacidad de reserva.
-
Opcional: Si elegiste usar una política de posición compacta, agrega el siguiente subcampo
instancePropertiesal cuerpo de la solicitud:"resourcePolicies": [ "projects/PROJECT_ID/regions/REGION/resourcePolicies/POLICY_NAME" ]Reemplaza lo siguiente:
PROJECT_ID: Es el ID del proyecto de la política de posición compacta.REGION: Es la región de la política de posición compacta.POLICY_NAME: el nombre de la política de posición compacta.
-
Opcional: Si especificaste un tipo de máquina A2 estándar y deseas conectar discos SSD locales, agrega el siguiente campo al campo
disks[]para cada disco SSD local. Separa cada subcampodisks[](incluido el disco de arranque) con una coma.Asegúrate de que la cantidad de discos SSD locales que conectes esté permitida para tu tipo de máquina. Para obtener más detalles, consulta Acerca de los discos SSD locales en la documentación de Compute Engine.
{ "type": "SCRATCH", "initializeParams": { "diskType": "zones/ZONE/diskTypes/local-ssd" }, "autoDelete": true, "interface": "INTERFACE_TYPE" }Reemplaza lo siguiente:
ZONE: La zona que especificaste.INTERFACE_TYPE: Es el tipo de interfaz de disco que deseas usar para el disco SSD local. Si tu imagen de disco de arranque tiene controladores NVMe optimizados, especificaNVME. EspecificaSCSIpara otras imágenes.
Después de crear una VM con discos SSD locales, debes formatear y activar cada dispositivo antes de poder usarlo.
- Envía la solicitud.
Spot
Antes de enviar la solicitud, revisa todos los pasos que se indican a continuación para determinar si debes incluir campos adicionales.
POST https://compute.googleapis.com/compute/v1/projects/PROJECT_ID/zones/ZONE/instances/bulkInsert
{
"namePattern": "NAME_PATTERN",
"count": "COUNT",
"instanceProperties": {
"machineType": "MACHINE_TYPE",
"disks": [
{
"boot": true,
"initializeParams": {
"diskSizeGb": "DISK_SIZE",
"diskType": "DISK_TYPE",
"sourceImage": "projects/IMAGE_PROJECT/global/images/family/IMAGE_FAMILY"
},
"mode": "READ_WRITE",
"type": "PERSISTENT"
}
],
"serviceAccounts": [
{
"email": "default",
"scopes": [
"https://www.googleapis.com/auth/cloud-platform"
]
}
],
"scheduling":
{
"provisioningModel": "SPOT",
"instanceTerminationAction": "TERMINATION_ACTION",
"onHostMaintenance": "TERMINATE",
"automaticRestart": false
}
}
}
Completa los siguientes pasos:
-
Reemplaza lo siguiente:
PROJECT_ID: ID del proyecto en el que deseas crear la instancia A2.ZONE: Especifica una zona en la que esté disponible el tipo de máquina que deseas usar. Si deseas especificar una política de posición compacta, debes usar una zona en la misma región que la política de posición compacta. Para obtener información sobre las regiones, consulta Disponibilidad de GPU por regiones y zonas.NAME_PATTERN: Es el patrón de nombres que se usará para las instancias de A2. Por ejemplo, si usasinstance-#para el patrón de nombre, se generan instancias A2 con nombres comoinstance-1yinstance-2, hasta la cantidad de instancias A2 especificadas por--count.COUNT: Es la cantidad de instancias de A2 que se crearán.MACHINE_TYPE: Es el tipo de máquina que se usará para la instancia A2. Para obtener más información, consulta Tipos de máquinas con GPU en la documentación de Compute Engine.DISK_SIZE: Es el tamaño del disco de arranque en GB. Para obtener más información, consulta Límites de tamaño de Google Cloud Hyperdisk o Límites de tamaño de Persistent Disk, según el tipo de disco.DISK_TYPE: El tipo de disco de arranque. Para obtener más información sobre los tipos de discos compatibles con tu tipo de máquina, consulta Máquinas con GPU en la familia de máquinas optimizadas para aceleradores en la documentación de Compute Engine.IMAGE_PROJECT: Es el ID del proyecto de la imagen de SO.IMAGE_FAMILY: Es la familia de imágenes de la imagen de SO que deseas usar. Para obtener una lista de todos los sistemas operativos compatibles, consulta Sistemas operativos compatibles.TERMINATION_ACTION: Es la acción que se debe realizar cuando Compute Engine interrumpe la instancia, ya seaSTOP(predeterminada) oDELETE.
-
Opcional: Si elegiste usar una política de posición compacta, agrega el siguiente subcampo
instancePropertiesal cuerpo de la solicitud:"resourcePolicies": [ "projects/PROJECT_ID/regions/REGION/resourcePolicies/POLICY_NAME" ]Reemplaza lo siguiente:
PROJECT_ID: Es el ID del proyecto de la política de posición compacta.REGION: Es la región de la política de posición compacta.POLICY_NAME: el nombre de la política de posición compacta.
-
Opcional: Si especificaste un tipo de máquina A2 estándar y deseas conectar discos SSD locales, agrega el siguiente campo al campo
disks[]para cada disco SSD local. Separa cada subcampodisks[](incluido el disco de arranque) con una coma.Asegúrate de que la cantidad de discos SSD locales que conectes esté permitida para tu tipo de máquina. Para obtener más detalles, consulta Acerca de los discos SSD locales en la documentación de Compute Engine.
{ "type": "SCRATCH", "initializeParams": { "diskType": "zones/ZONE/diskTypes/local-ssd" }, "autoDelete": true, "interface": "INTERFACE_TYPE" }Reemplaza lo siguiente:
ZONE: La zona que especificaste.INTERFACE_TYPE: Es el tipo de interfaz de disco que deseas usar para el disco SSD local. Si tu imagen de disco de arranque tiene controladores NVMe optimizados, especificaNVME. EspecificaSCSIpara otras imágenes.
Después de crear una VM con discos SSD locales, debes formatear y activar cada dispositivo antes de poder usarlo.
- Envía la solicitud.
Para obtener más información sobre las opciones de configuración cuando creas VMs de forma masiva, consulta Crea VMs de forma masiva en la documentación de Compute Engine.
Instalar los controladores de GPU.
Después de crear una instancia, esta no puede usar sus GPUs a menos que ya estén instalados los controladores de GPU correctos. Si no especificaste una imagen del SO que incluya controladores de GPU, consulta Instala controladores de GPU en la documentación de Compute Engine.
Opcional: Habilita el modo de GPU de varias instancias de NVIDIA
El modo de GPU de instancias múltiples (MIG) es una función que puedes habilitar para una GPU de NVIDIA compatible. Después de crear una instancia, puedes habilitar el modo de MIG en una sola GPU conectada a tu máquina. Con el modo MIG habilitado, la GPU única se particiona en hasta siete instancias de GPU independientes. Cada instancia se ejecuta de manera simultánea, cada una con su propia memoria, caché y multiprocesadores de transmisión. Luego, puedes ejecutar diferentes cargas de trabajo en estas instancias de GPU en paralelo. Para obtener más información sobre el uso del modo MIG, consulta la Guía del usuario de GPU de instancias múltiples (MIG) en la documentación de NVIDIA.¿Qué sigue?
- Consulta los detalles de una VM
- Obtén una lista de las VM
- Verifica el consumo de la reserva
- Soluciona problemas de consumo de reservas