View a markdown version of this page

Modifier ou générer un identifiant de correspondance pour un flux de travail de correspondance basé sur des règles - Résolution des entités AWS

Les traductions sont fournies par des outils de traduction automatique. En cas de conflit entre le contenu d'une traduction et celui de la version originale en anglais, la version anglaise prévaudra.

Modifier ou générer un identifiant de correspondance pour un flux de travail de correspondance basé sur des règles

Un identifiant de correspondance est l'identifiant généré Résolution des entités AWS et appliqué à chaque ensemble d'enregistrements correspondant après l'exécution d'un flux de travail correspondant. Cela fait partie des métadonnées de flux de travail correspondantes incluses dans la sortie.

Lorsque vous devez mettre à jour les enregistrements d'un client existant ou ajouter un nouveau client à votre ensemble de données, vous pouvez utiliser la Résolution des entités AWS console ou l'GenerateMatchIdAPI. La modification d'un identifiant de correspondance existant permet de maintenir la cohérence lorsque vous mettez à jour les informations sur les clients. La génération d'un nouvel identifiant de correspondance est nécessaire lorsque vous ajoutez des clients non identifiés auparavant à votre système.

Note

Des frais supplémentaires s'appliquent, que vous utilisiez la console ou l'API. Le type de traitement que vous choisissez affecte à la fois la précision et le temps de réponse de l'opération.

Real-time exigences correspondantes

Pour appeler l'GenerateMatchIdAPI sur un flux de travail de correspondance basé sur des règles avancées, définissez enableRealTimeMatching sur. true Pour les flux de travail de correspondance simples, la correspondance en temps réel est toujours disponible et vous n'avez pas besoin de définir cet indicateur.

Vous ne pouvez pas activer la correspondance en temps réel sur les flux de travail qui utilisent l'un des éléments suivants :

  • Attributs flous : CosineSoundex, ou Levenshtein

  • EmptyValues=Ignore

S'il enableRealTimeMatching est défini surtrue, le flux de travail ne peut pas être utilisé avec l'StartMatchingJobAPI pour exécuter des tâches de flux de travail.

Important

Si vous révoquez Résolution des entités AWS les autorisations d'accès à votre compartiment S3 alors qu'une tâche est en cours, les résultats Résolution des entités AWS seront toujours traités et facturés, mais vous ne pourrez pas les envoyer à votre compartiment. Pour éviter ce problème, assurez-vous qu'il Résolution des entités AWS dispose des autorisations appropriées pour écrire dans votre compartiment S3 avant de démarrer une tâche. Si les autorisations sont révoquées pendant le traitement, Résolution des entités AWS tente de fournir à nouveau les résultats jusqu'à 30 jours après la fin de la tâche une fois que vous avez rétabli les autorisations de compartiment correctes.

La procédure suivante vous guide tout au long du processus de recherche ou de génération d'un identifiant de correspondance, de sélection d'un type de traitement et d'affichage des résultats.

Console
Pour modifier ou générer un Match ID à l'aide de la console
  1. Connectez-vous à Console de gestion AWS et ouvrez la Résolution des entités AWS console à l'adresse https://console.aws.amazon.com/entityresolution/.

  2. Dans le volet de navigation de gauche, sous Workflows, choisissez Matching.

  3. Choisissez le flux de travail correspondant basé sur des règles qui a été traité (le statut de la tâche est Terminé).

  4. Sur la page des détails du flux de travail correspondant, choisissez l'onglet Identifiants correspondants.

  5. Choisissez Modifier ou générer un identifiant de correspondance.

    Note

    L'option Modifier ou générer un identifiant de correspondance n'est disponible que pour les flux de travail correspondants qui utilisent la cadence de traitement automatique. Si vous avez sélectionné la cadence de traitement manuel, cette option apparaîtra inactive. Pour utiliser cette option, modifiez votre flux de travail afin d'utiliser la cadence de traitement automatique. Pour plus d'informations sur la modification des flux de travail, consultezModifier un flux de travail correspondant.

  6. Sélectionnez le AWS Glue tableau dans la liste déroulante.

    S'il n'y a qu'une seule AWS Glue table dans le flux de travail, elle est sélectionnée par défaut.

  7. Choisissez le type de traitement.

    • Cohérent  : vous pouvez rechercher un identifiant de correspondance existant ou générer et enregistrer immédiatement un nouvel identifiant de correspondance. Cette option offre la précision la plus élevée et le temps de réponse le plus lent.

    • Contexte (affiché comme EVENTUAL dans l'API) : vous pouvez rechercher un identifiant de correspondance existant ou en générer immédiatement un nouveau. L'enregistrement mis à jour est enregistré en arrière-plan. Cette option offre une réponse initiale rapide, les résultats complets étant disponibles ultérieurement dans S3.

    • Génération rapide d'un identifiant (comme indiqué EVENTUAL_NO_LOOKUP dans l'API) : vous pouvez créer un nouvel identifiant correspondant sans en rechercher un existant. L'enregistrement mis à jour est enregistré en arrière-plan. Cette option offre la réponse la plus rapide. Il est recommandé uniquement pour les enregistrements uniques.

  8. Pour les attributs Record,

    1. Entrez la valeur de l'identifiant unique.

    2. Entrez une valeur pour chaque clé de correspondance qui correspondra aux enregistrements existants en fonction des règles configurées dans votre flux de travail.

  9. Choisissez Find match ID et enregistrez l'enregistrement.

    Un message de réussite apparaît, indiquant que l'identifiant de correspondance a été trouvé ou qu'un nouvel identifiant de correspondance a été généré et que l'enregistrement a été enregistré.

  10. Affichez l'ID de correspondance correspondant et la règle associée qui a été enregistrée dans le flux de travail correspondant dans le message de réussite.

  11. (Facultatif) Pour copier l'identifiant correspondant, choisissez Copier.

API
Pour modifier ou générer un identifiant de correspondance à l'aide de l'API
Note

Pour appeler cette API avec succès, vous devez d'abord avoir exécuté avec succès un flux de travail de correspondance basé sur des règles à l'aide de l'StartMatchingJob API.

Pour une liste complète des langages de programmation pris en charge, consultez la section Voir aussi du GenerateMatchId.

  1. Ouvrez un terminal ou une invite de commande pour effectuer la demande d'API.

  2. Créez une requête POST vers le point de terminaison suivant :

    /matchingworkflows/workflowName/generateMatches
  3. Dans l'en-tête de la demande, définissez la Content-type valeur sur application/json.

  4. Dans l'URI de la demande, spécifiez votreworkflowName.

    Le workflowName must :

    • Comporter entre 1 et 255 caractères

    • Correspond au modèle [a-z A-Z _0-9-] *

  5. Pour le corps de la requête, fournissez le code JSON suivant :

    { "processingType": "string", "records": [ { "inputSourceARN": "string", "recordAttributeMap": { "string" : "string" }, "uniqueId": "string" } ] }

    Où :

    • processingType(facultatif) - La valeur par défaut est. CONSISTENT Choisissez l'une des valeurs suivantes :

      • CONSISTENT- Pour une précision maximale avec un temps de réponse plus lent

      • EVENTUAL- Pour une réponse initiale plus rapide grâce au traitement en arrière-plan

      • EVENTUAL_NO_LOOKUP- Pour une réponse plus rapide lorsque l'on sait que les enregistrements sont uniques

    • records(obligatoire) - Tableau contenant exactement un objet d'enregistrement

  6. Envoyez la demande .

    En cas de succès, vous recevrez une réponse avec le code d'état 200 et un corps JSON contenant :

    { "failedRecords": [ { "errorMessage": "string", "inputSourceARN": "string", "uniqueId": "string" } ], "matchGroups": [ { "matchId": "string", "matchRule": "string", "records": [ { "inputSourceARN": "string", "recordId": "string" } ] } ] }

    Si l'appel échoue, l'un des messages d'erreur suivants peut s'afficher :

    • 403 - AccessDeniedException si vous ne disposez pas d'un accès suffisant

    • 404 - ResourceNotFoundException si la ressource est introuvable

    • 429 - ThrottlingException si la demande a été limitée

    • 400 - ValidationException si la validation de l'entrée échoue

    • 500 - en InternalServerException cas de panne de service interne