View a markdown version of this page

Faire correspondre les données d’entrée à l’aide d’un flux de travail de mise en relation - Résolution des entités AWS

Les traductions sont fournies par des outils de traduction automatique. En cas de conflit entre le contenu d'une traduction et celui de la version originale en anglais, la version anglaise prévaudra.

Faire correspondre les données d’entrée à l’aide d’un flux de travail de mise en relation

Un flux de travail de correspondance est une tâche de traitement de données qui combine et compare des données provenant de différentes sources d'entrée et détermine quels enregistrements correspondent en fonction de différentes techniques de correspondance. Résolution des entités AWS lit vos données depuis les emplacements que vous avez spécifiés, trouve des correspondances entre les enregistrements et attribue un identifiant de correspondance à chaque ensemble de données correspondant.

Le schéma suivant montre comment créer un flux de travail correspondant.

A summary of the four steps to create a matching workflow in Résolution des entités AWS

Types de flux de travail correspondants

Résolution des entités AWS prend en charge trois types de flux de travail correspondants :

Rule-based correspondant

Utilise des règles configurables pour identifier les enregistrements correspondants en fonction de la correspondance exacte ou floue des champs spécifiés. Vous définissez les critères de correspondance, tels que les noms correspondants orthographiés de la même manière ou les adresses dont le format est différent.

Correspondance par machine learning

Utilise des modèles d'apprentissage automatique pour identifier des enregistrements similaires, même lorsque les données présentent des variations, des erreurs ou des champs manquants. Cette approche permet de détecter des correspondances plus complexes que la correspondance basée sur des règles.

Correspondance basée sur les services des fournisseurs

Fait appel à des fournisseurs de données tiers pour enrichir et valider vos données avant de les comparer. Ce type de correspondance n'est pas compatible avec la sortie Connect Customer Customer Profiles.

Options de sortie de données

Résolution des entités AWS peut écrire des fichiers de sortie de données dans :

  • Un emplacement Amazon S3 que vous spécifiez

  • Connectez les profils clients (pour la déduplication des données clients)

Important

L'exportation vers Connect Customer Profiles n'est pas compatible avec la mise en correspondance basée sur les fournisseurs. Pour exporter vers Connect Customer Customer Profiles, vous devez utiliser une correspondance basée sur des règles ou une correspondance basée sur l'apprentissage automatique.

Vous pouvez Résolution des entités AWS utiliser le hachage des données de sortie si vous le souhaitez, ce qui vous permet de garder le contrôle de vos données.

Le tableau suivant présente les trois types de flux de travail correspondants et leurs destinations de sortie prises en charge.

Type correspondant sortie S3 Résultats des profils clients
basé sur des règles Oui Oui
basé sur l'apprentissage automatique Oui Oui
basé sur les services du fournisseur Oui Non

Résultats du flux de travail correspondants

Après avoir créé et exécuté un flux de travail correspondant, vous pouvez consulter les résultats dans l'emplacement S3 que vous avez spécifié ou dans Connect Customer Customer Profiles. Les flux de travail correspondants génèrent des identifiants une fois les données indexées.

Un flux de travail correspondant peut comporter plusieurs exécutions et les résultats (réussites ou erreurs) sont écrits dans un dossier portant le jobId nom.

Pour chaque exécution pour les destinations de sortie S3 :

  • La sortie de données contient à la fois un fichier pour les correspondances réussies et un fichier pour les erreurs

  • Les résultats positifs sont enregistrés success dans un dossier contenant plusieurs fichiers

  • Les erreurs sont écrites error dans un dossier comportant plusieurs champs

Pour chaque exécution de Connect Customer Customer Profiles, destinations de sortie :

  • Les dossiers clients dédupliqués sont envoyés directement à votre instance Connect Customer

  • Vous pouvez consulter l'historique de vos tâches récentes dans la Résolution des entités AWS console

  • Les profils existants dans Connect Customer ne sont pas inclus dans le processus de déduplication

Après avoir créé et exécuté un flux de travail correspondant, vous pouvez utiliser le résultat de la correspondance basée sur des règles ou de la correspondance par apprentissage automatique (ML) comme entrée de la correspondance basée sur les services des fournisseurs ou inversement pour répondre aux besoins de votre entreprise.

Par exemple, pour réduire les coûts d'abonnement des fournisseurs, vous pouvez d'abord exécuter une correspondance basée sur des règles pour trouver des correspondances sur vos données. Vous pouvez ensuite envoyer un sous-ensemble d'enregistrements non correspondants au service de correspondance basé sur le service du fournisseur. Notez que si vous envisagez d'exporter vers des profils clients, vous devez utiliser uniquement la correspondance basée sur des règles ou sur l'apprentissage automatique.

Pour plus d'informations sur la résolution des erreurs, consultezRésolution des problèmes liés aux workflows correspondants.