View a markdown version of this page

AWS Resilience Hub concetti - AWS Resilience Hub

Le traduzioni sono generate tramite traduzione automatica. In caso di conflitto tra il contenuto di una traduzione e la versione originale in Inglese, quest'ultima prevarrà.

AWS Resilience Hub concetti

Questi concetti possono aiutarti a comprendere meglio l'approccio adottato per migliorare AWS Resilience Hub la resilienza delle applicazioni e prevenire le interruzioni delle applicazioni.

Resilienza

La capacità di mantenere la disponibilità e di recuperare il software in caso di interruzioni operative e del software in un determinato lasso di tempo.

Obiettivo del punto di ripristino (RPO)

Il periodo di tempo massimo accettabile dall'ultimo punto di ripristino dei dati. Questo determina ciò che si considera una perdita di dati accettabile tra l’ultimo punto di ripristino e l’interruzione del servizio.

Obiettivo del tempo di ripristino (RTO)

Il ritardo massimo accettabile tra l'interruzione del servizio e il ripristino del servizio. Questo determina ciò che viene considerato un intervallo di tempo accettabile in caso di indisponibilità del servizio.

Obiettivo stimato in termini di tempo di ripristino del carico di lavoro

L'obiettivo stimato del tempo di ripristino del carico di lavoro (RTO stimato del carico di lavoro) è l'RTO che l'applicazione dovrebbe soddisfare in base alla definizione dell'applicazione importata e quindi eseguire una valutazione.

Obiettivo stimato del punto di ripristino del carico di lavoro

L'obiettivo stimato del punto di ripristino del carico di lavoro (RPO stimato del carico di lavoro) è l'RPO che l'applicazione dovrebbe soddisfare in base alla definizione dell'applicazione importata e quindi eseguire una valutazione.

Applicazione

Un' AWS Resilience Hub applicazione è una raccolta di risorse AWS supportate che vengono continuamente monitorate e valutate per gestirne il livello di resilienza.

Componente dell'applicazione

Un gruppo di AWS risorse correlate che funzionano e si guastano come una singola unità. Ad esempio, se si dispone di un database primario e di replica, entrambi i database appartengono allo stesso Application Component (AppComponent).

AWS Resilience Hub determina quali AWS risorse possono appartenere a quale tipo di AppComponent. Ad esempio, a DBInstance può appartenere a AWS::ResilienceHub::DatabaseAppComponent ma non aAWS::ResilienceHub::ComputeAppComponent.

Stato di conformità dell'applicazione

AWS Resilience Hub riporta i seguenti tipi di stato di conformità per le tue applicazioni.

Politica soddisfatta

Si stima che l'applicazione soddisfi gli obiettivi RTO e RPO definiti nella politica. Tutte le sue componenti soddisfano gli obiettivi politici definiti. Ad esempio, hai selezionato un obiettivo di RTO e RPO di 24 ore per le interruzioni tra AWS le regioni. AWS Resilience Hub puoi vedere che i tuoi backup vengono copiati nella tua regione di riserva. È comunque necessario mantenere il ripristino da una procedura operativa standard (SOP) di backup, testarla e cronometrarla. Questo è incluso nei consigli operativi e fa parte del tuo punteggio di resilienza complessivo.

Politica violata

Non è stato possibile stimare che l'applicazione soddisfi gli obiettivi RTO e RPO definiti nella politica. Una o più delle sue AppComponents non soddisfano gli obiettivi politici. Ad esempio, hai selezionato un obiettivo RTO e RPO di 24 ore per le interruzioni tra le AWS regioni, ma la configurazione del database non include alcun metodo di ripristino tra regioni, come una replica globale e copie di backup.

Non valutato

La domanda richiede una valutazione. Al momento non è valutata o tracciata.

Modifiche rilevate

Esiste una nuova versione pubblicata dell'applicazione che non è stata ancora valutata.

Rilevamento delle deviazioni

AWS Resilience Hub esegue una notifica di deriva durante l'esecuzione di una valutazione dell'applicazione per verificare se le modifiche alle AppComponent configurazioni hanno influito sullo stato di conformità dell'applicazione. Inoltre, controlla e rileva anche modifiche come l'aggiunta o l'eliminazione di risorse all'interno delle fonti di input dell'applicazione e le notifica. Per fare un confronto, AWS Resilience Hub utilizza la valutazione precedente in cui il componente applicativo ha soddisfatto la politica. AWS Resilience Hub rileva i seguenti tipi di derive:

  • Deriva delle politiche applicative: questo tipo di deriva identifica tutto ciò AppComponents che è conforme alla politica nella valutazione precedente ma non è stato conforme nella valutazione attuale.

  • Deriva delle risorse dell'applicazione: questo tipo di deriva identifica tutte le risorse deviate nella versione corrente dell'applicazione.

Valutazione della resilienza

AWS Resilience Hub utilizza un elenco di lacune e potenziali rimedi per misurare l'efficacia di una politica selezionata per la ripresa e il proseguimento di un disastro. Valuta lo stato di conformità di ogni componente o applicazione dell'applicazione alla policy. Questo rapporto include raccomandazioni per l'ottimizzazione dei costi e riferimenti a potenziali problemi.

Punteggio di resilienza

AWS Resilience Hub genera un punteggio che indica in che misura l'applicazione segue i nostri consigli per soddisfare la politica di resilienza, gli allarmi, le procedure operative standard (SOP) e i test dell'applicazione.

Tipo di interruzione

AWS Resilience Hub ti aiuta a valutare la resilienza rispetto ai seguenti tipi di interruzioni:

Applicazione

L'infrastruttura è sana, ma l'applicazione o lo stack software non funziona come necessario. Ciò può verificarsi dopo l'implementazione di nuovo codice, modifiche alla configurazione, danneggiamento dei dati o malfunzionamento delle dipendenze a valle.

Infrastruttura cloud

L'infrastruttura cloud non funziona come previsto a causa di un'interruzione. Un'interruzione può verificarsi a causa di un errore locale in uno o più componenti. Nella maggior parte dei casi, questo tipo di interruzione viene risolto riavviando, riciclando o ricaricando i componenti difettosi.

Interruzione dell'infrastruttura cloud AZ

Una o più zone di disponibilità non sono disponibili. Questo tipo di interruzione può essere risolto passando a una zona di disponibilità diversa.

Incidente nella regione dell'infrastruttura cloud

Una o più regioni non sono disponibili. Questo tipo di incidente può essere risolto passando a un altro Regione AWS.

AWS FIS esperimenti

AWS Resilience Hub consiglia esperimenti che utilizzano AWS FIS azioni per verificare la resilienza delle applicazioni rispetto a diversi tipi di interruzioni. Queste interruzioni includono applicazioni, infrastrutture, zone di disponibilità (AZ) o Regione AWS incidenti relativi ai componenti dell'applicazione.

Questi esperimenti consentono di effettuare le seguenti operazioni:

  • Iniettare un guasto.

  • Verifica che gli allarmi siano in grado di rilevare un'interruzione.

  • Verifica che le procedure di ripristino, o procedure operative standard (SOP), funzionino correttamente per ripristinare l'applicazione dall'interruzione.

I test per le SOP misurano l'RTO stimato del carico di lavoro e il RPO stimato del carico di lavoro. Puoi testare diverse configurazioni applicative e misurare se l'RTO e l'RPO in uscita soddisfano gli obiettivi definiti nella tua policy.

SOSTA

Una procedura operativa standard (SOP) è una serie di passaggi prescrittivi progettati per ripristinare in modo efficiente l'applicazione in caso di interruzione o allarme. In base alla valutazione dell'applicazione, AWS Resilience Hub consiglia una serie di SOP e si consiglia di preparare, testare e misurare le SOP prima che si verifichi un'interruzione per garantire un ripristino tempestivo.