Configurar tus cargas de trabajo para que dependan de un solo tipo de máquina o zona puede limitar tu capacidad de acceder a los recursos disponibles durante los picos de demanda. Para optimizar el aprovisionamiento de recursos de procesamiento y ayudar a que tus cargas de trabajo se ejecuten durante los picos de demanda, debes diseñar una infraestructura flexible de Compute Engine. La flexibilidad de la infraestructura te permite especificar varias zonas, tipos de máquinas o tiempos de inicio en lugar de una configuración fija. Compute Engine selecciona automáticamente entre tus opciones preferidas, lo que te ayuda a maximizar la disponibilidad de recursos, mejorar la relación precio-rendimiento y adoptar de forma segura el hardware más reciente.
En este documento, se explican las dimensiones de la flexibilidad de la infraestructura, sus beneficios y cómo elegir el enfoque adecuado para tu carga de trabajo. También describe las funciones pertinentes de Compute Engine, las consideraciones de diseño y los pasos para la adopción. Este documento está dirigido a arquitectos de soluciones, operadores de infraestructura e ingenieros de la nube que diseñan o administran infraestructura de procesamiento.
Flexibilidad de la infraestructura
Puedes diseñar la flexibilidad de la infraestructura en las siguientes tres dimensiones:
Flexibilidad de ubicación (dónde): Distribuye las instancias de Compute Engine en varias zonas de una región para maximizar el acceso a los recursos disponibles o selecciona automáticamente una sola zona con capacidad disponible para las cargas de trabajo sensibles a la latencia.
Flexibilidad del tipo de máquina (qué): Especifica una lista clasificada de tipos de máquinas compatibles, lo que permite que tu carga de trabajo use alternativas cuando sea necesario.
Flexibilidad de tiempo (cuándo): Solicita recursos con alta demanda, como aceleradores, en lugar de requerir el aprovisionamiento inmediato para cargas de trabajo que no necesitan comenzar de inmediato.
Beneficios de una infraestructura flexible
Adoptar una infraestructura flexible de Compute Engine proporciona los siguientes beneficios:
Automatiza la administración de la capacidad durante los aumentos repentinos de la demanda. Tus cargas de trabajo encuentran y usan automáticamente recursos en varios tipos de máquinas y zonas. Este enfoque ayuda a garantizar que tus solicitudes de ajuste de escala se realicen correctamente, incluso si el hardware que prefieres no está disponible temporalmente.
Simplifica la administración de la capacidad. Puedes reducir la sobrecarga operativa de buscar hardware disponible de forma manual. Compute Engine redirecciona automáticamente tus solicitudes según tus preferencias de respaldo, lo que reduce los cuellos de botella operativos.
Mitiga los riesgos de capacidad durante la transición al hardware más reciente. Puedes configurar tus implementaciones para priorizar las generaciones de hardware más recientes y conservar las generaciones anteriores como respaldo. Este parámetro de configuración hace que sea menos riesgoso adoptar las máquinas más recientes y demandadas, ya que, si las más recientes no están disponibles, tu implementación aún puede solicitar capacidad automáticamente para las máquinas más antiguas.
Optimiza el costo para el tráfico de referencia y el tráfico máximo. Puedes reservar capacidad solo para tu tráfico conocido de referencia y usar alternativas de tipo de máquina para controlar los aumentos impredecibles. Este enfoque reduce el costo de la capacidad de copia de seguridad inactiva. También puedes mantener la cobertura de descuentos en las series de máquinas y las regiones con los descuentos por compromiso de uso (CUD) flexibles de procesamiento, que evitan los precios según demanda cuando tu carga de trabajo cambia de serie de máquinas o de región.
Comparación de las dimensiones de flexibilidad
Puedes combinar la flexibilidad de ubicación con la flexibilidad de tipo de máquina o de tiempo. Sin embargo, la flexibilidad del tipo de máquina y la flexibilidad del tiempo son incompatibles en una misma implementación. Debes elegir entre las opciones de resguardo de hardware o esperar en una fila a que los recursos estén disponibles.
Para ayudarte a evaluar estas opciones, la siguiente tabla compara cómo funciona cada dimensión de flexibilidad. Para obtener orientación sobre qué enfoque se adapta a tu caso de uso específico, consulta Idoneidad y recomendaciones de cargas de trabajo.
| Flexibilidad de ubicación (dónde) | Flexibilidad del tipo de máquina (qué) | Flexibilidad de tiempo (cuándo) | |
|---|---|---|---|
| Cómo mejora la disponibilidad | Maximiza el acceso a los recursos disponibles en varias zonas de una región. | Se reducen las probabilidades de encontrar errores de recursos no disponibles, ya que se recurre a tipos de máquinas alternativos y compatibles. | Obtiene recursos de alta demanda colocando solicitudes en una cola para esperar a que haya capacidad disponible. |
| Cronograma de aprovisionamiento | Inmediato | Inmediato | En cola |
| Método de aprovisionamiento | Aprovisiona instancias de procesamiento según la disponibilidad en las zonas seleccionadas. | Aprovisiona instancias de procesamiento según la disponibilidad en los tipos de máquinas seleccionados. | Aprovisiona instancias de procesamiento cuando toda la capacidad solicitada está disponible. |
| Compatibilidad con tipos de máquinas | Admite uno o varios tipos de máquinas en diferentes zonas. | Usa varios tipos de máquinas. | Solo admite un tipo de máquina. |
Adecuación y recomendaciones de la carga de trabajo
La adopción de la flexibilidad de la infraestructura depende de la arquitectura y los requisitos de rendimiento de tu carga de trabajo. Para ayudarte a elegir el mejor enfoque, en la siguiente tabla, se resumen las dimensiones y configuraciones de flexibilidad recomendadas para algunos tipos de cargas de trabajo comunes.
| Tipo de carga de trabajo | Recomendación de flexibilidad |
|---|---|
| Procesamiento por lotes sin estado, computación de alta capacidad de procesamiento (HTC) desacoplada |
Flexibilidad de ubicación y tipo de máquina: Usa la política de flexibilidad de instancias con una de las siguientes opciones:
Estos enfoques permiten que tus cargas de trabajo se escalen en diversas zonas y tipos de máquinas para maximizar la disponibilidad de recursos. |
| Entrenamiento y ajuste de modelos de IA/AA, y trabajos por lotes a gran escala | Flexibilidad de tiempo: Usa modelos de aprovisionamiento que utilicen el programador dinámico de cargas de trabajo (DWS). Este enfoque mejora el acceso a los recursos de alta demanda, como los aceleradores, ya que coloca las solicitudes en una cola en lugar de requerir un aprovisionamiento inmediato a pedido. |
| Microservicios y frontends web | Flexibilidad de ubicación y tipo de máquina: Usa MIG regionales con la forma de distribución objetivo BALANCED y una política de flexibilidad de instancias. Selecciona tipos de máquinas con recuentos de CPU virtuales y memoria coincidentes para un ajuste de escala automático predecible. Además, habilita la actualización en la reparación para que cualquier instancia de procesamiento recreada use la configuración de flexibilidad de instancias más reciente. |
| Bases de datos de alta disponibilidad | Flexibilidad de ubicación y flexibilidad de tipo de máquina:
Usa MIGs regionales con la forma de distribución objetivo |
| Sistemas estrictamente limitados por la latencia | Flexibilidad de ubicación: Usa MIGs regionales con la forma de distribución ANY_SINGLE_ZONE. Esta forma proporciona flexibilidad de ubicación, ya que busca en todas las zonas de la región para encontrar capacidad suficiente y, al mismo tiempo, garantiza que todas las instancias se coloquen en la misma zona para mantener una latencia baja. |
Las configuraciones flexibles pueden introducir variaciones de hardware que pueden afectar el rendimiento de la aplicación. Cuando diseñes para la flexibilidad, evalúa las compensaciones entre maximizar la disponibilidad de recursos y mantener un rendimiento coherente. Para obtener orientación, consulta la siguiente sección sobre Cómo evaluar y adoptar una infraestructura flexible.
Funciones de flexibilidad principales en Compute Engine
Para automatizar la administración de la capacidad, puedes implementar flexibilidad en varias capas de tu infraestructura. Compute Engine proporciona funciones que permiten flexibilidad en cuanto a la ubicación, el tipo de máquina y el tiempo. Puedes configurar estas funciones de forma independiente o combinarlas para que se adapten a los requisitos de tu carga de trabajo.
Funciones de flexibilidad de ubicación
Las funciones de flexibilidad de ubicación maximizan la disponibilidad de recursos distribuyendo instancias de procesamiento en varias zonas de una región. Para maximizar este beneficio, selecciona regiones en las que tus tipos de máquinas preferidos estén disponibles en todas las zonas.
Puedes aplicar la flexibilidad de la ubicación a los siguientes tipos de implementación:
MIGs: Los MIGs regionales evalúan la capacidad en tiempo real durante la creación y el mantenimiento de instancias para aprovisionar instancias de procesamiento en las que hay recursos disponibles. Si una zona no tiene capacidad durante la reparación de una instancia, los MIG que usan las formas
ANYoBALANCEDpueden recrear automáticamente la instancia de procesamiento con errores en otra zona. Para obtener los mejores resultados, configura la forma de distribución objetivo según el objetivo de tu carga de trabajo:ANY: Se recomienda para lograr la máxima disponibilidad. Usa esta forma para maximizar la disponibilidad de recursos. Esta forma asigna instancias de procesamiento a cualquier zona con capacidad disponible y prioriza las reservas sin usar.BALANCED: Se recomienda para la alta disponibilidad. Usa esta forma para las cargas de trabajo de HA. Distribuye las instancias de procesamiento de manera uniforme en las zonas para protegerlas contra las interrupciones zonales y, al mismo tiempo, prioriza las zonas en las que hay recursos disponibles.ANY_SINGLE_ZONE: Se recomienda para una latencia baja. Usa esta forma para límites de latencia estrictos. Asigna todas las instancias de procesamiento de un MIG a una sola zona que tenga la mayor cantidad de recursos disponibles.
Para obtener más información, consulta Acerca de los MIG regionales.
Grupos de instancias no administrados: Estos grupos no admiten de forma nativa la flexibilidad de ubicación. En cambio, crea instancias de procesamiento de forma masiva con la API de
regionInstances.bulkInsert, que puede aprovisionar hasta 5,000 instancias de procesamiento independientes, con la forma de distribución objetivoANY_SINGLE_ZONE. Esta solicitud crea instancias de procesamiento en una sola zona, y puedes agregarlas a tu grupo no administrado. Ten en cuenta que, para las instancias de procesamiento independientes, Compute Engine evalúa la capacidad para seleccionar la zona solo durante la solicitud de creación de la instancia de procesamiento.Para obtener más información, consulta Agrupar las VMs no administradas.
Instancias de procesamiento independientes: Usa la solicitud regional de creación masiva de instancias (API de
regionInstances.bulkInsert) con una forma de distribución objetivo (ANY,BALANCEDoANY_SINGLE_ZONE) y establece un recuento mínimo. El recuento mínimo permite que tu solicitud aprovisione tantas instancias de procesamiento como sea posible en lugar de fallar por completo si la capacidad total no está disponible de inmediato. En el caso de las instancias de procesamiento independientes, Compute Engine evalúa la capacidad para seleccionar la zona solo durante la solicitud de creación de la instancia.Para obtener más información, consulta Acerca de la creación masiva de VMs.
Funciones de flexibilidad del tipo de máquina
Las funciones de flexibilidad del tipo de máquina permiten que tu implementación use una lista priorizada de tipos de máquinas alternativos. Si tu elección principal no está disponible, Compute Engine recurre automáticamente a tus tipos de máquinas secundarios. Para configurar esta capacidad, debes definir una política de flexibilidad de instancias, que consiste en una lista única o clasificada de varias selecciones de instancias.
Puedes aplicar una política de flexibilidad de instancias a los siguientes tipos de implementación:
MIGs: Adjunta una política de flexibilidad de instancias a un MIG para permitir que el grupo recurra automáticamente a hardware alternativo durante los picos de demanda. Si tu MIG usa VMs Spot, esta política prioriza automáticamente los tipos de máquinas de respaldo que ofrecen tiempos de actividad estimados más largos y un menor riesgo de interrupción. Para obtener más información, consulta Acerca de la flexibilidad de las instancias en los MIG.
Grupos de instancias no administrados: Como estos grupos no admiten de forma nativa las políticas de flexibilidad de instancias, puedes aprovisionar las instancias con la API de
regionInstances.bulkInserty, luego, agregarlas a tu grupo. En tu solicitud a la API, incluye una política de flexibilidad de instancias y especifica una sola zona (locationPolicy.zones.zone) o usa la forma de distribución objetivoANY_SINGLE_ZONE. Usar la formaANY_SINGLE_ZONEproporciona el beneficio adicional de flexibilidad de ubicación, ya que selecciona automáticamente la zona con la mayor cantidad de recursos disponibles. Ten en cuenta que, en el caso de las instancias independientes, Compute Engine aplica tu política de flexibilidad solo durante la solicitud de creación de la instancia.Para obtener más información sobre cómo crear instancias de procesamiento de forma masiva, consulta Crea VMs de forma masiva con flexibilidad de instancias y, para agregarlas a un grupo, consulta Agrupa VMs no administradas.
Instancias de procesamiento independientes: Para las cargas de trabajo que no requieren grupos de instancias, como los trabajos de procesamiento por lotes independientes, puedes usar la API de
regionInstances.bulkInsertcon una política de flexibilidad de instancias para aprovisionar las instancias de procesamiento. Ten en cuenta que, en el caso de las instancias independientes, Compute Engine aplica tu política de flexibilidad solo durante la solicitud de creación de la instancia.Para obtener más información, consulta Acerca de la flexibilidad de las instancias para las VMs creadas de forma masiva.
Ajusta la escala sin problemas en diferentes tipos de máquinas
Cuando configuras la flexibilidad del tipo de máquina, es posible que tus tipos de máquinas de respaldo tengan diferentes arquitecturas de hardware o especificaciones de disco. Si esas especificaciones son incompatibles con los tipos de máquinas en una selección de instancias, es posible que falle el aprovisionamiento.
Para usar tipos de máquinas con especificaciones incompatibles, debes definir anulaciones de propiedades en tu política de flexibilidad de instancias. Estos reemplazos garantizan que, cuando Compute Engine recurre a un tipo de máquina alternativo, se apliquen automáticamente la imagen de arranque, el tipo de disco o el nivel de referencia del procesador correctos que se requieren para ese hardware específico. Esta capacidad permite que tu implementación se escale en diferentes tipos de máquinas sin problemas y con mayores probabilidades de aprovisionamiento exitoso.
Para obtener más información, consulta Cómo funcionan las anulaciones de disco y plataforma de CPU.
Funciones de flexibilidad de horarios
Las funciones de flexibilidad de tiempo permiten que tus cargas de trabajo que no necesitan iniciarse de inmediato esperen recursos de alta demanda, como aceleradores, en lugar de requerir un aprovisionamiento inmediato.
Para implementar la flexibilidad de tiempo, según los requisitos de tu carga de trabajo, usa las siguientes funciones que utilizan DWS:
Para poner en cola tus solicitudes de capacidad hasta que los recursos estén disponibles, usa el modelo de aprovisionamiento de inicio flexible.
Para reservar capacidad futura para una fecha y hora específicas planificadas, usa las reservas futuras en modo de calendario.
Evalúa y adopta una infraestructura flexible
Antes de configurar la flexibilidad de ubicación o tipo de máquina, debes verificar que la ubicación y los tipos de máquinas que elijas sean compatibles entre sí y con los requisitos de tu carga de trabajo. Para ayudarte a diseñar y, luego, implementar con éxito tu infraestructura flexible, en las siguientes secciones, se proporcionan consideraciones clave para la evaluación y una estrategia de adopción incremental.
Consideraciones sobre la evaluación
Estas son algunas consideraciones clave para evaluar una infraestructura flexible:
Flexibilidad de ubicación: Distribuir tu carga de trabajo en varias zonas puede afectar la latencia de la red y aumentar los costos de transferencia de datos entre zonas.
Para obtener más información, consulta los siguientes documentos:
- Para ver los datos de latencia del tráfico entre las instancias de procesamiento en las zonas, consulta el panel de latencia de Google Cloud .
- Para calcular los costos de transferencia de datos asociados con el tráfico entre zonas, consulta los precios de las transferencias de datos de VM a VM dentro de Google Cloud.
Flexibilidad del tipo de máquina: Volver a tipos de máquinas alternativos puede generar variaciones en el rendimiento y los costos de la aplicación. La flexibilidad del tipo de máquina entre generaciones a menudo requiere que implementes anulaciones de la plataforma de CPU y disco. Debes verificar que los tipos de máquinas que deseas usar cumplan con los requisitos técnicos previos de tu aplicación.
Para obtener más información, consulta los siguientes documentos:
- Para comparar las especificaciones de las distintas series de máquinas, consulta la comparación de series de máquinas.
- Para ver los precios de las instancias de procesamiento, consulta Precios de las máquinas virtuales.
Estrategia de adopción
Según si diseñas una implementación nueva o migras una existente, elige la estrategia correspondiente de la siguiente manera:
Para una carga de trabajo nueva: Si estás diseñando una implementación nueva, te recomendamos que adoptes flexibilidad en el diseño de tu infraestructura. Para identificar las dimensiones de flexibilidad recomendadas para tu tipo de carga de trabajo, sigue las instrucciones que se indican en Idoneidad y recomendaciones de la carga de trabajo. Luego, elige el tipo de implementación que mejor admita tu carga de trabajo. Para obtener más información sobre los tipos de implementación y sus configuraciones de flexibilidad, consulta la sección Funciones de flexibilidad principales.
Para una implementación existente: Si deseas migrar una implementación que usa una sola zona o un solo tipo de máquina a una infraestructura flexible, te recomendamos que adoptes la flexibilidad de forma incremental para minimizar el riesgo. Puedes usar una estrategia de adopción incremental como la siguiente:
Agrega flexibilidad a la ubicación. Migra cargas de trabajo zonales a un MIG regional con la forma de distribución
BALANCEDoANY. Si usas un MIG regional con la formaEVEN, cámbialo aBALANCED. Este cambio es importante para los MIG que se expanden. Una restricción de capacidad temporal en una zona no bloqueará la operación de expansión. Como alternativa, si deseas crear instancias de procesamiento independientes, usa la API deregionInstances.bulkInsert.Agrega tipos de máquinas alternativos que compartan la misma arquitectura. Adjunta una política de flexibilidad de instancias que especifique tipos de máquinas que compartan la misma arquitectura de la CPU y compatibilidad con discos, por ejemplo,
n2-standard-8yn2d-standard-8.Agrega tipos de máquinas alternativos de diferentes generaciones y alinea los CUD. Incorpora las generaciones de máquinas más recientes, como
n4-standard-8, y usa anulaciones de disco según sea necesario. Además, se incluyen descuentos por uso de respaldo con CUD flexibles de Compute.
Para garantizar una adopción segura y exitosa tanto para las implementaciones nuevas como para las migraciones incrementales, recomendamos el siguiente flujo de trabajo de lanzamiento:
Valida y compara los resultados. Prueba tu aplicación en todas las familias de máquinas, combinaciones de discos y zonas seleccionadas en un entorno que no sea de producción.
Lleva a producción y escala. Implementa de forma progresiva tus políticas de flexibilidad de instancias o formas de distribución de MIG regionales en un subconjunto de tu flota de producción antes de expandirte a nivel global.
Supervisa y optimiza. Supervisa continuamente tus tasas de resguardo, métricas de rendimiento y costos para definir mejor tu lista priorizada de tipos de máquinas. Cuando uses MIG, para hacer un seguimiento de la distribución de instancias de procesamiento en tiempo real en los tipos de máquinas y las zonas, usa el panel de supervisión de la distribución de instancias de MIG. Para obtener instrucciones, consulta Supervisa la distribución de instancias en los MIG.
Prácticas recomendadas
Para maximizar la eficiencia y la capacidad de recuperación de tu infraestructura flexible, usa las prácticas recomendadas que se describen en las siguientes secciones.
Prácticas recomendadas para la flexibilidad de la ubicación
Usa la posición regional que tiene en cuenta la capacidad. Implementa cargas de trabajo con MIG regionales o la creación masiva de VM regionales. Selecciona la forma de distribución
BALANCEDoANY, ya que estas formas permiten que Compute Engine evalúe la capacidad en tiempo real en todas las zonas de la región para colocar automáticamente las instancias de procesamiento donde haya recursos disponibles.Elige regiones que admitan el tipo de máquina en varias zonas: Implementa cargas de trabajo en regiones en las que los tipos de máquinas seleccionados sean compatibles en todas las zonas. Este enfoque garantiza que las funciones de flexibilidad de ubicación tengan la mayor cantidad posible de zonas alternativas para enrutar solicitudes durante una limitación temporal de capacidad. Para obtener una lista de las regiones y zonas, consulta Regiones y zonas disponibles.
Verifica la disponibilidad de las implementaciones de VM Spot. Si tu implementación usa VMs Spot, verifica la disponibilidad en tiempo real y el tiempo de actividad esperado de las VMs Spot en varios tipos de máquinas y ubicaciones. Elige una región o zona con alta capacidad disponible y un tiempo de actividad que se adapte a tu carga de trabajo para reducir el riesgo de interrupción. Para obtener más información, consulta Cómo ver la disponibilidad de las VMs Spot (vista previa).
Prácticas recomendadas para la flexibilidad del tipo de máquina
Diversifica las familias de máquinas. Evita las políticas que varían solo en la cantidad de núcleos de CPU dentro de una misma familia, por ejemplo,
n2-standard-4yn2-standard-8. Las restricciones de capacidad localizadas pueden afectar a toda la familia de máquinas de forma simultánea. Para mejorar la disponibilidad, abarca varias generaciones y arquitecturas de máquinas, por ejemplo,n4-standard-8yn2-standard-8.Adopta nuevos tipos de máquinas y usa los más antiguos como alternativas. Incorpora las familias de máquinas más recientes a tu política de flexibilidad de instancias junto con las familias más antiguas para maximizar la disponibilidad.
Configura anulaciones de la plataforma de CPU y disco. Mezclar tipos de máquinas de diferentes generaciones puede implicar diferencias en los discos y las plataformas de CPU. Define anulaciones de la plataforma de disco y CPU en tu política de flexibilidad para garantizar que tu infraestructura se escale en todas las generaciones de máquinas sin problemas. Por ejemplo, configura Hyperdisk Balanced para las instancias de N4 y Persistent Disk para las conmutaciones por recuperación de N2.
Prioriza los tipos de máquinas más pequeños. Según la idoneidad de tu carga de trabajo, usa tipos de máquinas con menos CPU virtuales y memoria. Por ejemplo, en lugar de depender de un solo tipo de máquina, como
n2-standard-64, evalúa si tu carga de trabajo puede escalar en cuatro instancias de procesamiento que usen un tipo de máquinan2-standard-16. En general, los tipos de máquinas más pequeños tienen una mayor disponibilidad de recursos.Selecciona tipos de máquinas con un rendimiento similar. Especifica tipos de máquinas alternativos con tamaños similares de CPU virtuales y memoria. Por ejemplo, combina
n2d-standard-8,n4-standard-8yn4a-standard-8en tu política de flexibilidad de instancias. Este enfoque mantiene un rendimiento constante de la aplicación y, al mismo tiempo, mejora la disponibilidad de los recursos.Habilita la actualización en la reparación en los MIGs. De forma predeterminada, un MIG repara una instancia de procesamiento con errores usando su tipo de máquina original, lo que puede fallar si ese hardware no está disponible temporalmente. Habilita la actualización durante la reparación para que las reparaciones vuelvan automáticamente a los tipos de máquinas disponibles en tu política de flexibilidad. Para obtener más detalles, consulta Flexibilidad de instancias y VM VMs.
Incorpora VMs Spot con conmutación por error. Para las cargas de trabajo tolerantes a errores, combina las VMs Spot con flexibilidad de ubicación y tipo de máquina. Si Compute Engine interrumpe una VM Spot, estas funciones de flexibilidad permiten que tu implementación busque automáticamente tipos de máquinas o zonas alternativas. Esta estrategia ayuda a mantener la disponibilidad de recursos para tu carga de trabajo a un costo más bajo que el aprovisionamiento estándar.
Prácticas recomendadas para la flexibilidad horaria
Selecciona las cargas de trabajo adecuadas como objetivo. Implementa flexibilidad de tiempo para las cargas de trabajo que tienen horas de inicio flexibles, pero requieren recursos de alta demanda, como aceleradores. Este requisito incluye el entrenamiento previo de modelos pequeños, el ajuste de modelos, las simulaciones de computación de alto rendimiento (HPC) y la inferencia por lotes.
Selecciona la función adecuada para tu línea de tiempo. Usa el modelo de aprovisionamiento de inicio flexible para poner en cola solicitudes de trabajos de duración definida que se ejecuten hasta por siete días. Para obtener recursos de alta demanda por hasta 90 días o más, usa el modelo de aprovisionamiento vinculado a la reserva.
Optimiza los tiempos de espera de las VM de inicio flexible. Cuando intentes crear VMs de inicio flexible, especifica un tiempo de espera más largo si tu carga de trabajo debe ejecutarse en una zona específica. Cuanto más esperes, mayores serán las probabilidades de que Compute Engine pueda aprovisionar los recursos solicitados. Si deseas crear VMs independientes de inicio flexible y tu carga de trabajo puede iniciarse en cualquier zona de una región, especifica un tiempo de espera de cero segundos. Si la solicitud de creación falla porque los recursos no están disponibles, intenta de inmediato la solicitud de creación en otra zona.
Alinea las reservas y los descuentos con la flexibilidad de la carga de trabajo
Para equilibrar la disponibilidad y los costos de los recursos, haz coincidir tus descuentos por compromiso de uso (CUD) con la estrategia de capacidad que elegiste para tu carga de trabajo:
Uso constante en varios tipos de máquinas: Si tu carga de trabajo admite varios tipos de máquinas y tiene un uso constante, configura la flexibilidad del tipo de máquina y usa los CUD flexibles de procesamiento. La flexibilidad del tipo de máquina mejora las tasas de éxito del aprovisionamiento, ya que usa hardware alternativo cuando tu elección principal no tiene capacidad. Los CUD flexibles de Compute son descuentos basados en el gasto que se aplican a tu gasto de procesamiento apto, independientemente de la serie de máquinas específica que aprovisione Compute Engine.
Modelo de referencia estable con picos de tráfico: Si tu carga de trabajo tiene un modelo de referencia predecible, pero puede experimentar picos impredecibles, protege tu modelo de referencia predecible con reservas y CUD basados en recursos. Para controlar los picos de tráfico, configura la flexibilidad del tipo de máquina y usa los CUDs flexibles de procesamiento para cubrir las máquinas alternativas de respaldo. En tu política de flexibilidad de instancias, asigna las preferencias de la siguiente manera:
Mayor preferencia: Tipos de máquinas reservadas con CUD basados en recursos
Preferencias más bajas: Tipos de máquinas alternativos y uso de CUD flexibles para procesamiento
Compute Engine primero usa tus compromisos basados en recursos y, luego, tus compromisos flexibles de procesamiento para cubrir el uso restante apto.
Cargas de trabajo de hardware estrictamente fijas: Si tu carga de trabajo depende de un solo tipo de máquina, usa reservas y CUDs basados en recursos. Las reservas proporcionan una alta garantía de capacidad para hardware específico y se deben considerar para las cargas de trabajo fundamentales para la empresa. Los CUD basados en recursos proporcionan descuentos para este uso predecible y de estado estable.
Para obtener más información, consulta Elige un tipo de reserva y Descuentos por compromiso de uso (CUDs) para Compute Engine.
Consideraciones de diseño para las reservas
Si tu estrategia incluye reservas, revisa las siguientes consideraciones de diseño:
Prioriza los tipos de máquinas reservadas. Si usas reservas con flexibilidad de tipo de máquina, agrega los tipos de máquinas reservados a la preferencia más alta en la política de flexibilidad de instancias. Esta configuración ayuda a Compute Engine a priorizar tus reservas por sobre la capacidad a pedido.
Evalúa el alcance de tus reservas. Evita crear reservas en respuesta a restricciones de capacidad temporales. Si tu carga de trabajo usa flexibilidad de ubicación, como los MIG regionales, es posible que Compute Engine distribuya instancias a otras zonas de la región. En este caso, una reserva zonal estricta puede generar recursos inactivos y sin usar.
Limitaciones
Cuando diseñes una infraestructura flexible, se aplicarán las siguientes limitaciones generales. Para conocer las limitaciones más detalladas, consulta las secciones de Limitaciones en las páginas de las funciones respectivas.
Incompatibilidad de funciones: No puedes combinar la flexibilidad del tipo de máquina y la flexibilidad del tiempo en una sola implementación. Las funciones que habilitan la flexibilidad de tiempo solo admiten una configuración de tipo de máquina por solicitud.
Flexibilidad durante la creación inicial: En el caso de las instancias de procesamiento creadas de forma masiva, la evaluación de capacidad y la política de flexibilidad de instancias solo se aplican durante la solicitud inicial de creación de instancias de procesamiento. Las instancias de procesamiento creadas de forma masiva no se redireccionan automáticamente a zonas o tipos de máquinas alternativos durante las reparaciones ni cuando escalas tu infraestructura.
Implementación en una sola zona: Los MIG zonales no admiten funciones de flexibilidad y no se recomiendan. Para adoptar la flexibilidad de tipo de máquina en un diseño de una sola zona, crea un MIG regional y selecciona explícitamente solo una zona.
¿Qué sigue?
- Aprende a usar un MIG para distribuir VMs en varias zonas de una región.
- Obtén más información para configurar la flexibilidad de instancias en grupos de instancias administrados.
- Obtén más información para crear VMs de forma masiva con flexibilidad de instancias.
- Obtén más información sobre los CUD en Compute Engine.