Les traductions sont fournies par des outils de traduction automatique. En cas de conflit entre le contenu d'une traduction et celui de la version originale en anglais, la version anglaise prévaudra.
AWS Resilience Hub concepts
Ces concepts peuvent vous aider à mieux comprendre AWS Resilience Hub l'approche adoptée pour améliorer la résilience des applications et prévenir les pannes d'applications.
Résilience
La capacité à maintenir la disponibilité et à rétablir la situation en cas d'interruption logicielle et opérationnelle dans un laps de temps défini.
Objectif de point de restauration (RPO)
Durée maximale acceptable depuis le dernier point de restauration des données. Il détermine ce qui est considéré comme étant une perte de données acceptable entre le dernier point de reprise et l’interruption du service.
Objectif de temps de rétablissement (RTO)
Délai maximum acceptable entre l'interruption du service et le rétablissement du service. Elle détermine ce qui est considéré comme étant un créneau de temps acceptable d’indisponibilité du service.
Objectif de temps de restauration de la charge de travail estimé
L'objectif de temps de restauration de la charge de travail estimé (RTO de charge de travail estimé) est le RTO que votre application est censée atteindre sur la base de la définition de l'application importée, puis exécutez une évaluation.
Objectif de point de reprise de la charge de travail estimé
L'objectif de point de restauration de la charge de travail estimé (RPO de charge de travail estimé) est le RPO que votre application est censée atteindre sur la base de la définition de l'application importée, puis exécutez une évaluation.
Application
Une AWS Resilience Hub application est un ensemble de ressources AWS prises en charge qui sont surveillées et évaluées en permanence afin de gérer sa posture de résilience.
Composant d'application
Un groupe de AWS ressources connexes qui fonctionnent et échouent en tant qu'unité unique. Par exemple, si vous avez une base de données principale et une base de données répliquée, les deux bases de données appartiennent au même composant d'application (AppComponent).
AWS Resilience Hub détermine quelles AWS ressources peuvent appartenir à quel type de AppComponent. Par exemple, a DBInstance peut appartenir à AWS::ResilienceHub::DatabaseAppComponent mais pas àAWS::ResilienceHub::ComputeAppComponent.
État de conformité de l'application
AWS Resilience Hub indique les types de statut de conformité suivants pour vos applications.
Politique respectée
On estime que l'application atteint ses objectifs de RTO et de RPO définis dans la politique. Toutes ses composantes répondent aux objectifs politiques définis. Par exemple, vous avez sélectionné un objectif de RTO et de RPO de 24 heures pour les interruptions entre AWS les régions. AWS Resilience Hub peut voir que vos sauvegardes sont copiées dans votre région de secours. Vous êtes toujours tenu de maintenir une restauration à partir d'une procédure opérationnelle standard (SOP) de sauvegarde, de la tester et de la chronométrer. Cela figure dans les recommandations opérationnelles et fait partie de votre score de résilience global.
Politique violée
L'application n'a pas pu être estimée comme atteignant les objectifs RTO et RPO définis dans la politique. Un ou plusieurs d'entre eux AppComponents ne répondent pas aux objectifs de la politique. Par exemple, vous avez sélectionné un objectif RTO et RPO de 24 heures pour les interruptions entre AWS les régions, mais la configuration de votre base de données n'inclut aucune méthode de restauration interrégionale, telle qu'une réplication globale et des copies de sauvegarde.
Non évalué
La demande nécessite une évaluation. Il n'est actuellement ni évalué ni suivi.
Changements détectés
Il existe une nouvelle version publiée de la demande qui n'a pas encore été évaluée.
Détection des écarts
AWS Resilience Hub exécute une notification de dérive lors de l'exécution d'une évaluation de votre application afin de vérifier si les modifications apportées aux AppComponent configurations ont affecté l'état de conformité de votre application. En outre, il vérifie et détecte également les modifications telles que l'ajout ou la suppression de ressources dans les sources d'entrée de l'application et en informe. À des fins de comparaison, AWS Resilience Hub utilise l'évaluation précédente dans laquelle le composant de l'application respectait la politique. AWS Resilience Hub détecte les types de dérives suivants :
-
Dérive de la politique d'application : ce type de dérive identifie toutes les règles AppComponents qui étaient conformes à la politique lors de l'évaluation précédente mais qui ne l'ont pas été lors de l'évaluation en cours.
-
Dérive des ressources de l'application : ce type de dérive identifie toutes les ressources dérivées dans la version actuelle de l'application.
Évaluation de la résilience
AWS Resilience Hub utilise une liste de lacunes et de solutions potentielles pour mesurer l'efficacité d'une politique sélectionnée pour se remettre d'une catastrophe et poursuivre ses activités. Il évalue l'état de conformité de chaque composant de l'application ou de chaque application à la politique. Ce rapport inclut des recommandations d'optimisation des coûts et des références aux problèmes potentiels.
Score de résilience
AWS Resilience Hub génère un score qui indique dans quelle mesure votre application suit nos recommandations en matière de respect de la politique de résilience, des alarmes, des procédures opérationnelles standard (SOP) et des tests de l'application.
Type de perturbation
AWS Resilience Hub vous aide à évaluer la résilience face aux types de pannes suivants :
Application
L'infrastructure est saine, mais la pile d'applications ou de logiciels ne fonctionne pas comme il se doit. Cela peut se produire après le déploiement d'un nouveau code, des modifications de configuration, une corruption des données ou un dysfonctionnement des dépendances en aval.
Infrastructure cloud
L'infrastructure cloud ne fonctionne pas comme prévu en raison d'une panne. Une panne peut survenir en raison d'une erreur locale dans un ou plusieurs composants. Dans la plupart des cas, ce type de panne est résolu en redémarrant, en recyclant ou en rechargeant les composants défectueux.
Perturbation de l'infrastructure cloud AZ
Une ou plusieurs zones de disponibilité ne sont pas disponibles. Ce type de panne peut être résolu en passant à une autre zone de disponibilité.
Incident dans la région d'infrastructure cloud
Une ou plusieurs régions ne sont pas disponibles. Ce type d'incident peut être résolu en passant à un autre Région AWS.
AWS FIS expériences
AWS Resilience Hub recommande des expériences utilisant AWS FIS des actions pour vérifier la résilience des applications face à différents types de pannes. Ces pannes concernent les applications, l'infrastructure, les zones de disponibilité (AZ) ou les Région AWS incidents liés aux composants de l'application.
Ces expériences vous permettent d'effectuer les opérations suivantes :
-
Injectez un échec.
-
Vérifiez que les alarmes peuvent détecter une panne.
-
Vérifiez que les procédures de restauration, ou procédures opérationnelles standard (SOP), fonctionnent correctement pour rétablir l'application après la panne.
Les tests pour les SOP mesurent la charge de travail estimée RTO et la charge de travail RPO estimée. Vous pouvez tester différentes configurations d'applications et mesurer si le RTO et le RPO de sortie répondent aux objectifs définis dans votre politique.
SAVON
Une procédure opérationnelle standard (SOP) est un ensemble d'étapes prescriptives conçues pour rétablir efficacement votre application en cas de panne ou d'alarme. Sur la base de l'évaluation de l'application, AWS Resilience Hub recommande un ensemble de SOP et il est recommandé de préparer, de tester et de mesurer les SOP avant une interruption afin de garantir une reprise rapide.