View a markdown version of this page

Distribution des zones de disponibilité d’un groupe Auto Scaling - Amazon EC2 Auto Scaling

Les traductions sont fournies par des outils de traduction automatique. En cas de conflit entre le contenu d'une traduction et celui de la version originale en anglais, la version anglaise prévaudra.

Distribution des zones de disponibilité d’un groupe Auto Scaling

Les informations suivantes décrivent les stratégies de zone de disponibilité du groupe Auto Scaling.

Meilleur effort équilibré

Auto Scaling gère un nombre égal d'instances dans les zones de disponibilité activées. Si les tentatives de lancement échouent dans une zone de disponibilité, Auto Scaling tente de lancer les instances dans une autre zone de disponibilité saine. Cette stratégie est importante pour les applications qui nécessitent une redondance de zone de disponibilité et qui ne sont pas affectées par des groupes déséquilibrés.

Équilibré uniquement

Auto Scaling gère un nombre égal d'instances dans les zones de disponibilité activées. Si les tentatives de lancement échouent dans une zone de disponibilité, Auto Scaling continuera à tenter de lancer des instances dans la zone de disponibilité. Cette stratégie est importante pour répondre à certaines exigences, telles que les charges de travail basées sur le quorum ou si votre groupe Auto Scaling peut tolérer la perte d'une zone de disponibilité parce que vous disposez d'une capacité suffisante dans les zones de disponibilité restantes.

Les réserves se sont ensuite équilibrées

Auto Scaling lance d'abord des instances dans les réservations de capacité associées au groupe, en donnant la priorité à l'utilisation des réservations par rapport à une répartition uniforme entre les zones de disponibilité activées du groupe. Une fois toutes les réservations disponibles effectuées, Auto Scaling répartit la capacité restante de manière uniforme entre les zones de disponibilité activées. Utilisez cette stratégie pour les charges de travail sensibles aux coûts qui utilisent des réservations de capacité, telles que les charges de travail GPU, de calcul haute performance (HPC) ou d'apprentissage automatique. Avec cette stratégie, l'optimisation de l'utilisation des réservations est prioritaire par rapport à la distribution uniforme des zones de disponibilité.

Vous spécifiez les réservations à prioriser en fournissant un groupe de réservation de capacité ou un ID de réservation de capacité individuel. Vous pouvez spécifier la cible dans votre modèle de lancement ou dans le groupe Auto Scaling à l'aide de CapacityReservationTarget. Pour hiérarchiser plusieurs réservations, vous pouvez créer un groupe de ressources Capacity Reservation. Cette stratégie prend en charge les On-Demand réservations de capacité, les blocs de capacité et les réservations de capacité interruptibles.

Note

Lors de la mise à l'échelle, Auto Scaling supprime d'abord les instances qui ne figurent pas dans une réservation, afin de préserver l'utilisation de la réservation. Si une mise à l'échelle supplémentaire est requise, Auto Scaling supprime ensuite les instances réservées, en commençant par la zone de disponibilité qui compte le plus d'instances réservées.

La stratégie de distribution de la zone de disponibilité est sélectionnée dans la section Réseau de la Console de gestion AWS ou vous pouvez utiliser les commandes create-auto-scaling-group ou update-auto-scaling-group. https://awscli.amazonaws.com/v2/documentation/api/latest/reference/autoscaling/update-auto-scaling-group.html

Lorsque vous choisissez la stratégie Réservations puis équilibrée, vous devez également spécifier les réservations de capacité à prioriser, soit par groupe de ressources de réservation de capacité, soit par ID de réservation de capacité individuel.

Pour de plus amples informations, veuillez consulter Créer des groupes Auto Scaling à l’aide de modèles de lancement.