Optimiser le provisionnement du calcul

Si vous configurez vos charges de travail pour qu'elles dépendent d'un seul type de machine ou d'une seule zone, vous risquez de ne pas pouvoir accéder aux ressources disponibles en cas de pics de demande. Pour optimiser le provisionnement de calcul et assurer le bon fonctionnement de vos charges de travail lors des pics de demande, vous devez concevoir une infrastructure Compute Engine flexible. La flexibilité de l'infrastructure vous permet de spécifier plusieurs zones, types de machines ou heures de début au lieu d'une configuration fixe. Compute Engine sélectionne automatiquement vos options préférées, ce qui vous aide à maximiser la disponibilité des ressources, à améliorer le rapport prix/performances et à adopter les derniers matériels en toute sécurité.

Ce document explique les dimensions de la flexibilité de l'infrastructure, ses avantages et comment choisir l'approche adaptée à votre charge de travail. Il décrit également les fonctionnalités Compute Engine pertinentes, les considérations de conception et les étapes d'adoption. Ce document s'adresse aux architectes de solutions, aux opérateurs d'infrastructure et aux ingénieurs cloud qui conçoivent ou gèrent l'infrastructure de calcul.

Flexibilité de l'infrastructure

Vous pouvez concevoir la flexibilité de l'infrastructure selon les trois dimensions suivantes :

  • Flexibilité de l'emplacement (où) : répartissez les instances Compute Engine sur plusieurs zones d'une région pour maximiser l'accès aux ressources disponibles, ou sélectionnez automatiquement une seule zone avec une capacité disponible pour les charges de travail sensibles à la latence.

  • Flexibilité des types de machines (quoi) : spécifiez une liste classée de types de machines compatibles, ce qui permet à votre charge de travail d'utiliser des alternatives si nécessaire.

  • Flexibilité temporelle (quand) : mettez en file d'attente les demandes de ressources très demandées, telles que les accélérateurs, au lieu d'exiger un provisionnement immédiat pour les charges de travail qui n'ont pas besoin de démarrer immédiatement.

Avantages d'une infrastructure flexible

L'adoption d'une infrastructure Compute Engine flexible présente les avantages suivants :

  • Automatise la gestion de la capacité lors des pics de demande. Vos charges de travail trouvent et utilisent automatiquement des ressources dans plusieurs types de machines et zones. Cette approche permet de s'assurer que vos demandes de scaling aboutissent, même si votre matériel préféré est temporairement indisponible.

  • Simplifie la gestion des capacités. Vous pouvez réduire les coûts opérationnels liés à la recherche manuelle du matériel disponible. Compute Engine redirige automatiquement vos requêtes en fonction de vos préférences de secours, ce qui réduit les goulots d'étranglement opérationnels.

  • Atténue les risques liés à la capacité lors de la transition vers le matériel le plus récent. Vous pouvez configurer vos déploiements pour donner la priorité aux dernières générations de matériel et conserver les générations plus anciennes comme solution de secours. Ce paramètre permet d'adopter les machines les plus récentes et les plus demandées avec moins de risques. En effet, si les dernières machines ne sont pas disponibles, votre déploiement peut toujours demander automatiquement de la capacité pour les machines plus anciennes.

  • Optimise les coûts pour le trafic de référence et le trafic de pointe. Vous ne pouvez réserver de la capacité que pour votre trafic de référence connu et utiliser des types de machines de secours pour gérer les pics imprévisibles. Cette approche permet de réduire les dépenses liées à la capacité de sauvegarde inactive. Vous pouvez également maintenir la couverture des remises sur les séries de machines et les régions en utilisant des remises sur engagement d'utilisation flexibles pour le calcul, qui empêchent la tarification à la demande lorsque votre charge de travail change de série de machines ou de région.

Comparaison des dimensions de flexibilité

Vous pouvez combiner la flexibilité de l'emplacement avec la flexibilité du type de machine ou du temps. Toutefois, la flexibilité des types de machines et la flexibilité temporelle ne sont pas compatibles dans un même déploiement. Vous devez choisir entre les options de secours matérielles ou attendre dans une file d'attente que des ressources se libèrent.

Pour vous aider à évaluer ces options, le tableau suivant compare le fonctionnement de chaque dimension de flexibilité. Pour savoir quelle approche convient le mieux à votre cas d'utilisation spécifique, consultez Adéquation et recommandations des charges de travail.

Flexibilité géographique (où) Flexibilité des types de machines (qu'est-ce que c'est ?) Flexibilité temporelle (quand)
Comment cela améliore-t-il la disponibilité ? Maximise l'accès aux ressources disponibles dans plusieurs zones d'une région. Réduit les risques de rencontrer des erreurs de ressources indisponibles en revenant à d'autres types de machines compatibles. Obtient des ressources très demandées en plaçant les requêtes dans une file d'attente jusqu'à ce que de la capacité soit disponible.
Calendrier de provisionnement Immédiat Immédiat En file d'attente
Méthode de provisionnement Provisionne des instances de calcul en fonction de la disponibilité dans les zones sélectionnées. Provisionne des instances de calcul en fonction de la disponibilité des types de machines sélectionnés. Provisionne des instances de calcul lorsque toute la capacité demandée est disponible.
Types de machines compatibles Compatible avec un ou plusieurs types de machines dans les zones. Utilise plusieurs types de machines. Compatible avec un seul type de machine.

Adéquation et recommandations concernant les charges de travail

L'adoption de la flexibilité de l'infrastructure dépend de l'architecture et des exigences de performances de votre charge de travail. Pour vous aider à choisir la meilleure approche, le tableau suivant récapitule les dimensions et configurations de flexibilité recommandées pour certains types de charges de travail courants.

Type de charge de travail Recommandation de flexibilité
Traitement par lot sans état, calcul à haut débit (HTC) découplé

Flexibilité de l'emplacement et du type de machine : utilisez une stratégie de flexibilité des instances avec l'une des options suivantes :

  • Un groupe d'instances géré (MIG) régional avec une forme de distribution ANY
  • Création d'une instance de calcul par lot régionale configurée avec un nombre minimal pour permettre l'exécution partielle et avec une forme de distribution ANY

Ces approches permettent à vos charges de travail d'évoluer dans différentes zones et différents types de machines pour maximiser la disponibilité des ressources.

Entraînement et affinage de l'IA/du ML, et jobs par lot à grande échelle Flexibilité temporelle : utilisez des modèles de provisionnement qui utilisent le programmeur de charge de travail dynamique (DWS). Cette approche améliore l'accès aux ressources très demandées, telles que les accélérateurs, en plaçant les requêtes dans une file d'attente plutôt qu'en exigeant un provisionnement immédiat à la demande.
Microservices et interfaces Web Flexibilité de l'emplacement et du type de machine : utilisez des MIG régionaux avec la forme de distribution cible BALANCED et une règle de flexibilité des instances. Sélectionnez des types de machines avec un nombre de vCPU et de mémoire correspondant pour une autoscaling prévisible. Activez également la mise à jour lors de la réparation afin que toute instance de calcul recréée utilise la dernière configuration de flexibilité des instances.
Bases de données haute disponibilité

Flexibilité de l'emplacement et du type de machine : utilisez des MIG régionaux avec une forme de distribution cible BALANCED pour répartir les répliques sur plusieurs zones afin d'assurer une haute disponibilité. Pour éviter les écarts de performances entre les répliques, choisissez des types de machines dont les profils de performances sont très proches.

Systèmes à latence strictement limitée Flexibilité de l'emplacement : utilisez des MIG régionaux avec la forme de distribution ANY_SINGLE_ZONE. Cette forme offre une flexibilité d'emplacement en recherchant une capacité suffisante dans toutes les zones de la région, tout en veillant à ce que toutes les instances soient placées dans la même zone pour maintenir une faible latence.

Les configurations flexibles peuvent introduire des variations matérielles susceptibles d'affecter les performances des applications. Lorsque vous concevez des solutions flexibles, évaluez les compromis entre la maximisation de la disponibilité des ressources et le maintien de performances cohérentes. Pour obtenir des conseils, consultez la section suivante sur l'évaluation et l'adoption d'une infrastructure flexible.

Fonctionnalités de flexibilité de base dans Compute Engine

Pour automatiser la gestion de la capacité, vous pouvez implémenter de la flexibilité à plusieurs niveaux de votre infrastructure. Compute Engine fournit des fonctionnalités qui permettent de choisir l'emplacement, le type de machine et l'heure de manière flexible. Vous pouvez configurer ces fonctionnalités de manière indépendante ou les combiner pour répondre aux exigences de votre charge de travail.

Fonctionnalités de flexibilité de la localisation

Les fonctionnalités de flexibilité de l'emplacement maximisent la disponibilité des ressources en distribuant les instances de calcul dans plusieurs zones d'une région. Pour en profiter pleinement, sélectionnez des régions où vos types de machines préférés sont disponibles dans toutes les zones.

Vous pouvez appliquer la flexibilité de l'emplacement aux types de déploiement suivants :

  • MIG : les MIG régionaux évaluent la capacité en temps réel lors de la création et de la maintenance des instances pour provisionner des instances de calcul là où des ressources sont disponibles. Si une zone manque de capacité lors de la réparation d'une instance, les MIG utilisant les formes ANY ou BALANCED peuvent recréer automatiquement l'instance de calcul défaillante dans une autre zone. Pour obtenir les meilleurs résultats, configurez la forme de distribution cible en fonction de l'objectif de votre charge de travail :

    • ANY : recommandé pour une disponibilité maximale. Utilisez cette forme pour maximiser la disponibilité des ressources. Cette forme alloue des instances de calcul à n'importe quelle zone disposant de capacité disponible et donne la priorité aux réservations inutilisées.

    • BALANCED : recommandé pour la haute disponibilité. Utilisez cette forme pour les charges de travail HA. Il répartit les instances de calcul de manière uniforme entre les zones pour se protéger contre les pannes zonales, tout en privilégiant les zones où des ressources sont disponibles.

    • ANY_SINGLE_ZONE : recommandé pour une faible latence. Utilisez cette forme pour des limites de latence strictes. Il alloue toutes les instances de calcul d'un MIG dans une seule zone disposant du plus grand nombre de ressources disponibles.

    Pour en savoir plus, consultez À propos des MIG régionaux.

  • Groupes d'instances non gérés : ces groupes ne sont pas compatibles avec la flexibilité de l'emplacement. Créez plutôt des instances de calcul de manière groupée à l'aide de l'API regionInstances.bulkInsert, qui peut provisionner jusqu'à 5 000 instances de calcul autonomes avec la forme de distribution cible ANY_SINGLE_ZONE. Cette demande crée des instances de calcul dans une seule zone, que vous pouvez ajouter à votre groupe non géré. Notez que pour les instances de calcul autonomes, Compute Engine évalue la capacité pour sélectionner la zone uniquement lors de la demande de création d'instance de calcul.

    Pour en savoir plus, consultez Regrouper des VM non gérées.

  • Instances de calcul autonomes : utilisez la requête régionale de création d'instances groupées (API regionInstances.bulkInsert) avec une forme de distribution cible (ANY, BALANCED ou ANY_SINGLE_ZONE) et définissez un nombre minimal. Le nombre minimal permet à votre demande de provisionner autant d'instances de calcul que possible plutôt que d'échouer complètement si la capacité totale n'est pas immédiatement disponible. Pour les instances de calcul autonomes, Compute Engine évalue la capacité pour sélectionner la zone uniquement lors de la demande de création d'instance.

    Pour en savoir plus, consultez À propos de la création groupée de VM.

Fonctionnalités de flexibilité des types de machines

Les fonctionnalités de flexibilité des types de machines permettent à votre déploiement d'utiliser une liste prioritaire de types de machines alternatifs. Si votre premier choix n'est pas disponible, Compute Engine passe automatiquement à vos types de machines secondaires. Pour configurer cette fonctionnalité, vous devez définir une règle de flexibilité des instances, qui se compose d'une seule ou d'une liste classée de plusieurs sélections d'instances.

Vous pouvez appliquer une stratégie de flexibilité des instances aux types de déploiement suivants :

  • MIG : associez une règle de flexibilité des instances à un MIG pour permettre au groupe de revenir automatiquement à un autre matériel en cas de pics de demande. Si votre MIG utilise des VM Spot, cette règle donne automatiquement la priorité aux types de machines de secours qui offrent des temps d'activité estimés plus longs et un risque de préemption plus faible. Pour en savoir plus, consultez À propos de la flexibilité des instances dans les MIG.

  • Groupes d'instances non gérés : comme ces groupes ne sont pas compatibles en mode natif avec les règles de flexibilité des instances, vous pouvez provisionner les instances à l'aide de l'API regionInstances.bulkInsert, puis les ajouter à votre groupe. Dans votre requête API, incluez une règle de flexibilité des instances et spécifiez une seule zone (locationPolicy.zones.zone) ou utilisez la forme de distribution cible ANY_SINGLE_ZONE. L'utilisation de la forme ANY_SINGLE_ZONE offre l'avantage supplémentaire de la flexibilité de l'emplacement en sélectionnant automatiquement la zone avec le plus de ressources disponibles. Notez que pour les instances autonomes, Compute Engine n'applique votre stratégie de flexibilité que lors de la demande de création d'instance.

    Pour en savoir plus sur la création d'instances de calcul de manière groupée, consultez Créer des VM de manière groupée avec la flexibilité des instances. Pour les ajouter à un groupe, consultez Regrouper des VM non gérées.

  • Instances de calcul autonomes : pour les charges de travail qui ne nécessitent pas de groupes d'instances, comme les jobs de traitement par lot indépendants, vous pouvez utiliser l'API regionInstances.bulkInsert avec une règle de flexibilité des instances pour provisionner les instances de calcul. Notez que pour les instances autonomes, Compute Engine n'applique votre stratégie de flexibilité que lors de la demande de création d'instance.

    Pour en savoir plus, consultez À propos de la flexibilité des instances pour les VM créées de manière groupée.

Adaptez-vous facilement à différents types de machines

Lorsque vous configurez la flexibilité des types de machines, vos types de machines de secours peuvent avoir des architectures matérielles ou des spécifications de disque différentes. Si ces spécifications sont incompatibles avec les types de machines d'une sélection d'instances, le provisionnement peut échouer.

Pour utiliser des types de machines dont les spécifications sont incompatibles, vous devez définir des remplacements de propriétés dans votre règle de flexibilité des instances. Ces remplacements garantissent que lorsque Compute Engine revient à un autre type de machine, il applique automatiquement l'image de démarrage, le type de disque ou la référence du processeur appropriés requis pour ce matériel spécifique. Cette fonctionnalité permet à votre déploiement de s'adapter à différents types de machines de manière fluide, avec de meilleures chances de provisionnement réussi.

Pour en savoir plus, consultez Fonctionnement des remplacements de plate-forme de disque et de processeur.

Fonctionnalités de flexibilité temporelle

Les fonctionnalités de flexibilité temporelle permettent à vos charges de travail qui n'ont pas besoin de démarrer immédiatement d'attendre des ressources très demandées, telles que des accélérateurs, au lieu de nécessiter un provisionnement immédiat.

Pour implémenter la flexibilité temporelle, en fonction des exigences de votre charge de travail, utilisez les fonctionnalités suivantes qui utilisent le programmeur de charge de travail dynamique :

Évaluer et adopter une infrastructure flexible

Avant de configurer la flexibilité de l'emplacement ou du type de machine, vous devez vérifier que l'emplacement et les types de machines que vous choisissez sont compatibles entre eux et avec les exigences de votre charge de travail. Pour vous aider à concevoir et à implémenter votre infrastructure flexible, les sections suivantes fournissent des éléments d'évaluation clés et une stratégie d'adoption incrémentielle.

Points à prendre en compte pour l'évaluation

Voici quelques points clés à prendre en compte pour évaluer une infrastructure flexible :

  • Flexibilité de l'emplacement : la répartition de votre charge de travail sur plusieurs zones peut avoir une incidence sur la latence de votre réseau et augmenter les coûts de transfert de données interzones.

    Pour en savoir plus, consultez les documents suivants :

  • Flexibilité des types de machines : le recours à d'autres types de machines peut entraîner des variations dans les performances et les coûts des applications. La flexibilité des types de machines d'une génération à l'autre vous oblige souvent à implémenter des remplacements de plate-forme de disque et de processeur. Vous devez vérifier que les types de machines que vous souhaitez utiliser répondent aux prérequis techniques de votre application.

    Pour en savoir plus, consultez les documents suivants :

Stratégie d'adoption

Selon que vous concevez un nouveau déploiement ou que vous migrez un déploiement existant, choisissez la stratégie correspondante :

  • Pour une nouvelle charge de travail : si vous concevez un nouveau déploiement, nous vous recommandons d'adopter la flexibilité dans la conception de votre infrastructure. Pour identifier les dimensions de flexibilité recommandées pour votre type de charge de travail, suivez les conseils de la section Adéquation et recommandations pour les charges de travail. Ensuite, choisissez le type de déploiement qui prend le mieux en charge votre charge de travail. Pour en savoir plus sur les types de déploiements et leurs configurations de flexibilité, consultez la section Fonctionnalités de flexibilité de base.

  • Pour un déploiement existant : si vous souhaitez migrer un déploiement qui utilise une seule zone ou un seul type de machine vers une infrastructure flexible, nous vous recommandons d'adopter la flexibilité de manière incrémentielle pour minimiser les risques. Vous pouvez utiliser une stratégie d'adoption incrémentielle, par exemple :

    1. Ajoutez de la flexibilité à vos lieux. Migrez les charges de travail zonales vers un MIG régional avec la forme de distribution BALANCED ou ANY. Si vous utilisez un MIG régional avec la forme EVEN, remplacez-la par BALANCED. Cette modification est importante pour les MIG qui évoluent. Une contrainte de capacité temporaire dans une zone n'empêchera pas l'opération de scale-out. Si vous souhaitez créer des instances de calcul autonomes, utilisez l'API regionInstances.bulkInsert.

    2. Ajoutez d'autres types de machines qui partagent la même architecture. Associez une stratégie de flexibilité des instances qui spécifie des types de machines partageant la même architecture de processeur et la même compatibilité avec les disques (par exemple, n2-standard-8 et n2d-standard-8).

    3. Ajoutez d'autres types de machines de différentes générations et alignez les CUD. Intégrez les dernières générations de machines, telles que n4-standard-8, et utilisez les remplacements de disque si nécessaire. Couvrez également les remises pour l'utilisation de secours avec les remises sur engagement d'utilisation flexibles de Compute Engine.

Pour garantir une adoption sûre et réussie pour les nouveaux déploiements et les migrations incrémentielles, nous vous recommandons le workflow de déploiement suivant :

  • Validez et comparez. Testez votre application dans toutes les familles de machines, combinaisons de disques et zones sélectionnées dans un environnement hors production.

  • Passez à la production et évoluez. Déployez progressivement vos stratégies de flexibilité des instances ou vos formes de distribution de MIG régionaux sur un sous-ensemble de votre parc de production avant de les étendre à l'échelle mondiale.

  • Surveillez et optimisez. Surveillez en continu vos taux de secours, vos métriques de performances et vos coûts pour affiner votre liste de types de machines classés par ordre de priorité. Lorsque vous utilisez des MIG, pour suivre la distribution des instances de calcul en temps réel entre les types de machines et les zones, utilisez le tableau de bord de surveillance de la distribution des instances de MIG. Pour obtenir des instructions, consultez Surveiller la distribution des instances dans les MIG.

Bonnes pratiques

Pour maximiser l'efficacité et la résilience de votre infrastructure flexible, suivez les bonnes pratiques décrites dans les sections suivantes.

Bonnes pratiques pour la flexibilité de l'emplacement

  • Utilisez le placement régional tenant compte de la capacité. Déployez des charges de travail à l'aide de MIG régionaux ou de la création groupée de VM régionales. Sélectionnez la forme de distribution BALANCED ou ANY, car ces formes permettent à Compute Engine d'évaluer la capacité en temps réel dans toutes les zones de la région afin de placer automatiquement les instances de calcul là où des ressources sont disponibles.

  • Choisissez des régions qui acceptent le type de machine dans plusieurs zones : déployez des charges de travail dans des régions où les types de machines sélectionnés sont acceptés dans toutes les zones. Cette approche garantit que les fonctionnalités de flexibilité de l'emplacement disposent du nombre maximal de zones alternatives pour acheminer les requêtes en cas de limitation temporaire de la capacité. Pour obtenir la liste des régions et des zones, consultez Régions et zones disponibles.

  • Vérifiez la disponibilité des déploiements de VM Spot. Si votre déploiement utilise des VM Spot, vérifiez la disponibilité en temps réel et le temps d'activité attendu des VM Spot pour plusieurs types de machines et emplacements. Choisissez une région ou une zone avec une capacité disponible élevée et un temps d'activité adapté à votre charge de travail pour réduire le risque de préemption. Pour en savoir plus, consultez Afficher la disponibilité des VM Spot (aperçu).

Bonnes pratiques pour la flexibilité des types de machines

  • Diversifiez vos familles de machines. Évitez les règles qui ne varient que par le nombre de cœurs de processeur au sein d'une même famille (par exemple, n2-standard-4 et n2-standard-8). Des contraintes de capacité localisées peuvent affecter l'ensemble de la famille de machines simultanément. Pour améliorer la disponibilité, répartissez les générations et les architectures de machines (par exemple, n4-standard-8 et n2-standard-8).

  • Adoptez de nouveaux types de machines, avec les anciens comme solutions de secours. Intégrez les dernières familles de machines à votre règle de flexibilité des instances en plus des anciennes familles pour maximiser la disponibilité.

  • Configurer les remplacements de plate-forme de disque et de processeur Combiner des types de machines de différentes générations peut entraîner des différences au niveau des disques et des plates-formes de processeurs. Définissez des remplacements de plate-forme de disque et de processeur dans votre règle de flexibilité pour vous assurer que votre infrastructure évolue de manière fluide entre les générations de machines. Par exemple, configurez Hyperdisk Balanced pour les instances N4 et Persistent Disk pour les instances N2 de secours.

  • Privilégiez les types de machines plus petits. En fonction de l'adéquation de votre charge de travail, utilisez des types de machines avec moins de vCPU et de mémoire. Par exemple, au lieu de vous appuyer sur un seul type de machine comme n2-standard-64, évaluez si votre charge de travail peut évoluer sur quatre instances de calcul qui utilisent chacune un type de machine n2-standard-16. Les types de machines plus petits ont généralement une disponibilité des ressources plus élevée.

  • Sélectionnez des types de machines aux performances similaires. Spécifiez d'autres types de machines avec des tailles de vCPU et de mémoire similaires. Par exemple, combinez n2d-standard-8, n4-standard-8 et n4a-standard-8 dans votre règlement sur la flexibilité des instances. Cette approche permet de maintenir des performances d'application cohérentes tout en améliorant la disponibilité des ressources.

  • Activez la mise à jour lors de la réparation dans les MIG. Par défaut, un MIG répare une instance de calcul défaillante en utilisant son type de machine d'origine, ce qui peut échouer si ce matériel est temporairement indisponible. Activez l'option "Mise à jour en cas de réparation" pour que les réparations reviennent automatiquement aux types de machines disponibles dans votre règle de flexibilité. Pour en savoir plus, consultez Flexibilité des instances et réparation des VM.

  • Intégrez des VM Spot avec des solutions de secours. Pour les charges de travail tolérantes aux pannes, combinez les VM Spot avec la flexibilité de l'emplacement et du type de machine. Si Compute Engine préempte une VM Spot, ces fonctionnalités de flexibilité permettent à votre déploiement de rechercher automatiquement d'autres types de machines ou zones. Cette stratégie permet de maintenir la disponibilité des ressources pour votre charge de travail à un coût inférieur à celui du provisionnement standard.

Bonnes pratiques pour la flexibilité horaire

  • Ciblez les bonnes charges de travail. Implémentez une flexibilité temporelle pour les charges de travail dont les heures de début sont flexibles, mais qui nécessitent des ressources très demandées, comme des accélérateurs. Cette exigence inclut le pré-entraînement de petits modèles, l'affinage de modèles, les simulations de calcul hautes performances (HPC) et l'inférence par lot.

  • Sélectionnez la fonctionnalité appropriée pour votre timeline. Utilisez le modèle de provisionnement à démarrage flexible pour mettre en file d'attente les requêtes pour les jobs à durée définie s'exécutant jusqu'à sept jours. Pour obtenir des ressources très demandées pendant 90 jours ou plus, utilisez le modèle de provisionnement lié à la réservation.

  • Optimisez les temps d'attente des VM à démarrage flexible. Lorsque vous tentez de créer des VM à démarrage flexible, spécifiez un temps d'attente plus long si votre charge de travail doit s'exécuter dans une zone spécifique. Plus l'attente est longue, plus vous avez de chances que Compute Engine puisse provisionner les ressources demandées. Si vous souhaitez créer des VM Flex-start autonomes et que votre charge de travail peut démarrer dans n'importe quelle zone d'une région, spécifiez un temps d'attente de zéro seconde. Si la requête de création échoue en raison de l'indisponibilité des ressources, réessayez immédiatement dans une autre zone.

Aligner les réservations et les remises sur la flexibilité des charges de travail

Pour équilibrer la disponibilité des ressources et les coûts, faites correspondre vos remises sur engagement d'utilisation (CUD) à la stratégie de capacité que vous avez choisie pour votre charge de travail :

  • Utilisation stable sur plusieurs types de machines : si votre charge de travail est compatible avec plusieurs types de machines et que son utilisation est stable, configurez la flexibilité des types de machines et utilisez des CUD flexibles pour le calcul. La flexibilité des types de machines améliore les taux de réussite du provisionnement en utilisant du matériel alternatif lorsque votre choix principal manque de capacité. Les remises sur engagement d'utilisation flexibles Compute sont des remises basées sur les dépenses qui s'appliquent à vos dépenses de calcul éligibles, quelle que soit la série de machines spécifique provisionnée par Compute Engine.

  • Ligne de base stable avec des pics de trafic : si votre charge de travail présente une ligne de base prévisible, mais peut connaître des pics imprévisibles, sécurisez votre ligne de base prévisible avec des réservations et des CUD basées sur les ressources. Pour gérer les pics de trafic, configurez la flexibilité du type de machine et utilisez des remises sur engagement d'utilisation flexibles pour couvrir les autres machines de secours. Dans votre règle de flexibilité des instances, attribuez les préférences comme suit :

    • Préférence la plus élevée : types de machines réservés avec remises sur engagement d'utilisation basées sur les ressources

    • Préférences inférieures : types de machines alternatifs et utilisation de CUD flexibles pour le calcul

    Compute Engine utilise d'abord vos engagements basés sur les ressources, puis vos engagements flexibles de calcul pour couvrir l'utilisation éligible restante.

  • Charges de travail matérielles strictement fixes : si votre charge de travail repose sur un seul type de machine, utilisez des réservations et des remises sur engagement d'utilisation basées sur les ressources. Les réservations offrent une grande assurance de capacité pour du matériel spécifique et doivent être envisagées pour les charges de travail stratégiques. Les CUD basées sur les ressources offrent des remises pour cet usage stable et prévisible.

Pour en savoir plus, consultez Choisir un type de réservation et Remises sur engagement d'utilisation pour Compute Engine.

Points à prendre en compte pour concevoir les réservations

Si votre stratégie inclut des réservations, examinez les considérations de conception suivantes :

  • Priorisez les types de machines réservés. Si vous utilisez des réservations avec flexibilité du type de machine, ajoutez vos types de machines réservés à la préférence la plus élevée dans la règle de flexibilité des instances. Cette configuration aide Compute Engine à donner la priorité à vos réservations par rapport à la capacité à la demande.

  • Évaluez le champ d'application de vos réservations. Évitez de créer des réservations en réponse à des contraintes de capacité temporaires. Si votre charge de travail utilise la flexibilité de l'emplacement, comme les MIG régionaux, Compute Engine peut distribuer les instances à d'autres zones de la région. Dans ce scénario, une réservation zonale stricte peut entraîner des ressources inactives et inutilisées.

Limites

Lorsque vous concevez une infrastructure flexible, les limites générales suivantes s'appliquent. Pour en savoir plus sur les limites, consultez les sections "Limites" sur les pages des fonctionnalités concernées.

  • Incompatibilité des fonctionnalités : vous ne pouvez pas combiner la flexibilité des types de machines et la flexibilité temporelle dans un même déploiement. Les fonctionnalités qui permettent la flexibilité temporelle n'acceptent qu'une seule configuration de type de machine par demande.

  • Flexibilité lors de la création initiale : pour les instances de calcul créées de manière groupée, l'évaluation de la capacité et la règle de flexibilité des instances ne s'appliquent qu'à la demande de création initiale d'instance de calcul. Les instances de calcul créées de manière groupée ne sont pas automatiquement redirigées vers d'autres zones ou types de machines lors des réparations ou lorsque vous faites évoluer votre infrastructure.

  • Déploiement dans une seule zone : les MIG zonaux ne sont pas compatibles avec les fonctionnalités de flexibilité et ne sont pas recommandés. Pour adopter la flexibilité des types de machines pour une conception à zone unique, créez un MIG régional et sélectionnez explicitement une seule zone.

Étapes suivantes