Descripción general de la capacidad

AI Hypercomputer admite varias opciones de consumo para ayudarte a obtener y usar recursos de procesamiento. En este documento, se proporciona una descripción general de cómo puedes obtener capacidad para cada opción de consumo.

Cómo obtener capacidad

En la siguiente tabla, se describe cómo puedes obtener capacidad para cada opción de consumo.

Opción de consumo Proceso para obtener capacidad Implicaciones de precios
Reservas futuras en AI Hypercomputer

Para obtener recursos de reserva futuros, el proceso es el siguiente:

  1. Comunícate con el equipo de cuentas para reservar capacidad.
  2. La cuota aumenta automáticamente antes de que se entregue la capacidad. No es necesario que realices ninguna acción.
  3. Cuando crees una instancia o un clúster de Compute Engine, especifica el modelo de aprovisionamiento vinculado a la reserva. Las instancias y los clústeres de procesamiento se aprovisionan a partir de tu capacidad reservada.
Se te cobra por todo el período de la reserva, ya sea que uses o no los recursos reservados durante todo el período. Para obtener más información, consulta la sección Facturación de reservas de la documentación de reservas de Compute Engine.
Reservas futuras de menos de 90 días (en modo de calendario)

Para obtener recursos de reserva futuros, el proceso es el siguiente:

  1. Busca la capacidad disponible y reserva recursos.
  2. No se cobra ninguna cuota y no es necesario que realices ninguna acción.
  3. Cuando crees una instancia o un clúster de procesamiento, debes especificar el modelo de aprovisionamiento vinculado a la reserva. Las instancias y los clústeres de procesamiento se aprovisionan a partir de tu capacidad reservada.
Se te cobra por todo el período de la reserva, ya sea que uses o no los recursos reservados durante todo el período. Para obtener más información, consulta los precios del Programador dinámico de cargas de trabajo.
Inicio flexible

Para esta opción de consumo, no se requiere ninguna reserva. Para obtener recursos de inicio flexible, el proceso es el siguiente:

  1. Debes solicitar una cuota interrumpible para el tipo de máquina de GPU que deseas usar.
  2. Cuando crees instancias o clústeres de procesamiento con una de las siguientes opciones, especifica el modelo de aprovisionamiento de inicio flexible:

    Cuando los recursos solicitados estén disponibles, Compute Engine aprovisionará tus VMs. Tus VMs se ejecutan durante un máximo de siete días.

Se te cobra cuando los recursos están en uso. Los recursos aprovisionados con el inicio flexible obtienen automáticamente descuentos a través de los precios del Programador dinámico de cargas de trabajo.
A pedido

Para esta opción de consumo, la reserva de capacidad es opcional. Los recursos a pedido solo están disponibles para las GPU generales (como N1, G2, G4, A2 o A3 Edge). Para obtener estos recursos a pedido, el proceso es el siguiente:

  1. Solicita la cuota de GPU estándar para el tipo de máquina que deseas usar. Para obtener más información, consulta Solicita un aumento de la cuota.
  2. Para verificar la disponibilidad, consulta las regiones preferidas para tu hardware en la lista de disponibilidad de GPU de Compute Engine por región y zona.
  3. Crea una instancia de procesamiento o un clúster y especifica el modelo de aprovisionamiento estándar. Los recursos se aprovisionan de inmediato según la capacidad disponible.
Se aplican tarifas estándar a pedido mientras los recursos están en uso.
Reservas según demanda

Las reservas según demanda (a veces denominadas reservas) solo están disponibles para las GPU generales (como G2, G4, A2 o A3 Edge). Para reservar capacidad, el proceso es el siguiente:

  1. Solicita la cuota de GPU estándar para tu tipo de máquina. Para obtener más detalles, consulta Solicita un aumento de la cuota.
  2. Crea una reserva según demanda para tu VM y tipo de GPU específicos con la Google Cloud consola, gcloud CLI o cualquier otro método. Para obtener detalles sobre todos los métodos para crear reservas, consulta Crea una reserva para un solo proyecto.
  3. Para **aprovisionar tus recursos**, crea una instancia o un clúster y orienta tu reserva específica.
Se aplican tarifas estándar durante todo el período de la reserva. Aplica CUDs para obtener ahorros significativos.
Reservas futuras estándar

Para esta opción de consumo, reservas capacidad para una fecha futura. Las reservas futuras estándar usan el modelo de aprovisionamiento estándar y solo están disponibles para las GPU generales.

  1. Solicita la cuota de GPU estándar para tu tipo de máquina. Para obtener más detalles, consulta Solicita un aumento de la cuota.
  2. Crea una solicitud de reserva futura para tu VM y tipo de GPU específicos.
  3. Cuando la reserva alcance su hora de inicio, crea instancias de procesamiento con tu capacidad reservada.
Se aplican tarifas estándar durante todo el período de la reserva. Aplica CUDs para obtener ahorros significativos.
Spot

Para esta opción de consumo, no se requiere ninguna reserva. Para obtener recursos Spot, el proceso es el siguiente:

  1. Debes solicitar una cuota interrumpible para el tipo de máquina de GPU que deseas usar.
  2. Consulta la disponibilidad de recursos en la región o zona en la que deseas crear instancias de procesamiento.
  3. Cuando crees una instancia o un clúster de procesamiento, especifica el modelo de aprovisionamiento Spot. Los recursos se aprovisionan a medida que la capacidad está disponible, pero se pueden interrumpir en cualquier momento.
Se te cobra cuando los recursos están en uso. Las VMs Spot obtienen automáticamente descuentos a través de los precios de las VMs Spot.

¿Qué sigue?