View a markdown version of this page

Utilisation d'un pipeline OpenSearch d'ingestion avec Amazon RDS - OpenSearch Service Amazon

Les traductions sont fournies par des outils de traduction automatique. En cas de conflit entre le contenu d'une traduction et celui de la version originale en anglais, la version anglaise prévaudra.

Utilisation d'un pipeline OpenSearch d'ingestion avec Amazon RDS

Vous pouvez utiliser un pipeline d' OpenSearch ingestion avec Amazon RDS pour exporter les données existantes et diffuser les modifications (telles que la création, la mise à jour et la suppression) vers les domaines et collections Amazon OpenSearch Service. Le pipeline OpenSearch d'ingestion intègre une infrastructure de capture des données de modification (CDC) afin de fournir un moyen à grande échelle et à faible latence de diffuser en continu des données depuis Amazon RDS. RDS pour MySQL et RDS pour PostgreSQL sont pris en charge.

Vous pouvez utiliser Amazon RDS comme source pour traiter les données de deux manières : avec ou sans instantané initial complet. Un instantané initial complet est un instantané de tables spécifiées et cet instantané est exporté vers Amazon S3. À partir de là, un pipeline d' OpenSearch ingestion l'envoie vers un index d'un domaine ou le partitionne vers plusieurs index d'un domaine. Pour garantir la OpenSearch cohérence des données dans Amazon RDS, le pipeline synchronise tous les événements de création, de mise à jour et de suppression des tables des instances Amazon RDS avec les documents enregistrés dans l' OpenSearch index ou les index.

Lorsque vous utilisez un instantané initial complet, votre pipeline d' OpenSearch ingestion ingère d'abord l'instantané, puis commence à lire les données des flux de modifications Amazon RDS. Il finit par rattraper son retard et maintient la cohérence des données en temps quasi réel entre Amazon RDS et OpenSearch.

Vous pouvez également utiliser l'intégration d' OpenSearch Ingestion avec Amazon RDS pour suivre les modifications, capturer les données et ingérer toutes les mises à jour dans Aurora vers OpenSearch. Choisissez cette option si vous disposez déjà d'un instantané complet provenant d'un autre mécanisme, ou si vous souhaitez simplement capturer toutes les modifications apportées aux données dans une instance Amazon RDS.

Lorsque vous choisissez cette option, vous devez configurer Amazon RDS pour la journalisation binaire MySQL ou configurer la réplication logique pour l'instance de base de données Amazon RDS pour PostgresSQL.