本文属于机器翻译版本。若本译文内容与英语原文存在差异,则一律以英文原文为准。
创建基于提供商服务的匹配工作流程
基于提供商服务的匹配使您能够将已知标识符与首选数据服务提供商进行匹配。
AWS Entity Resolution 数据匹配服务 目前支持以下数据提供者服务:
-
LiveRamp
-
TransUnion
-
统一 ID 2.0
有关支持的提供商服务的更多信息,请参阅准备第三方输入数据。
您可以对这些提供商使用公开订阅, AWS Data Exchange 也可以直接与数据提供商协商私人报价。有关创建新订阅或重复使用提供商服务的现有订阅的更多信息,请参阅步骤 1:在上订阅提供商服务 AWS Data Exchange。
以下各节介绍如何创建基于提供商的匹配工作流程。
使用创建匹配的工作流程 LiveRamp
该 LiveRamp 服务提供一个名为 ramPid 的标识符。RampID 是需求方平台中最常用的 ID 之一,用于为广告活动创建受众。使用匹配的工作流程 LiveRamp,您可以将经过哈希处理的电子邮件地址解析为 Rampids。
注意
AWS Entity Resolution 数据匹配服务 支持 PII-based rampID 分配。
先决条件
在使用创建匹配的工作流程之前 LiveRamp,您必须:
-
创建架构映射。有关更多信息,请参阅 创建架构映射。
-
订阅该 LiveRamp 服务
-
为 Amazon S3 数据暂存存储桶配置适当的权限,以便在其中临时写入匹配的工作流程输出
在使用创建 ID 映射工作流程之前 LiveRamp,将以下权限添加到 S3 数据暂存存储桶。
将每个 <user input placeholder> 替换为您自己的信息。
staging-bucket |
Amazon S3 存储桶,在运行基于提供商服务的工作流程时临时存储您的数据。 |
要创建匹配的工作流程,请执行以下操作 LiveRamp:
-
登录 AWS 管理控制台 并打开 AWS Entity Resolution 数据匹配服务 控制台,地址为https://console.aws.amazon.com/entityresolution/
。 -
在左侧导航窗格的 “工作流程” 下,选择 “匹配” 。
-
在匹配工作流程页面的右上角,选择创建匹配工作流程。
-
对于步骤 1:指定匹配的工作流程详细信息,请执行以下操作:
-
输入匹配的工作流程名称和可选的描述。
-
对于数据输入,选择AWS Glue 数据库AWS 区域、AWS Glue 表,然后选择相应的架构映射。
您最多可以添加 20 个数据输入。
-
默认情况下,“标准化数据” 选项处于选中状态,因此在匹配之前对数据输入进行归一化。
注意
在 “创建架构映射” 中,仅以下场景支持标准化:
-
如果将以下名称子类型分组:名字、中间名、姓氏。
-
如果将以下地址子类型分组:街道地址 1 、街道地址 2:街道地址 3 名称、城市名称、州、国家/地区、邮政编码。
-
如果将以下电话子类型分组:电话号码、电话国家/地区代码。
如果您使用的是仅限电子邮件的解析流程,请取消选择 “标准化数据” 选项,因为只有经过哈希处理的电子邮件才用于输入数据。
-
-
要指定服务访问权限,请选择一个选项并采取建议的操作。
Option 推荐操作 创建并使用新的服务角色 -
AWS Entity Resolution 数据匹配服务 使用此表所需的策略创建服务角色。
-
默认服务角色名称为
entityresolution-matching-workflow-<timestamp>。 -
您必须拥有创建角色并附加策略的权限。
-
如果您的输入数据已加密,请选择 “此数据由 KMS 密钥加密” 选项。然后,输入用于解密数据输入的密AWS KMS 钥。
使用现有服务角色 -
从下拉列表中选择一个现有服务角色名称。
如果您有列出角色的权限,则会显示角色列表。
如果您没有列出角色的权限,可以输入要使用的角色的 Amazon 资源名称 (ARN)。
如果没有现有的服务角色,则使用现有服务角色选项不可用。
-
通过选择在 IAM 中查看外部链接来查看服务角色。
默认情况下, AWS Entity Resolution 数据匹配服务 不会尝试更新现有角色策略以添加必要的权限。
-
-
(可选)要为资源启用标签,请选择添加新标签,然后输入密钥和值对。
-
选择下一步。
-
-
对于步骤 2:选择匹配技术:
-
对于 “匹配方法”,选择 “提供商服务” 。
-
对于提供商服务,请选择LiveRamp。
注意
确保您的数据输入文件格式和标准化符合提供商服务的准则。
有关匹配工作流程的输入文件格式指南的更多信息,请参阅 LiveRamp 文档中的通过 ADX
执行身份解析。 -
对于LiveRamp 产品,请从下拉列表中选择一个产品。
注意
如果您选择分配 PII,则在执行实体解析时必须提供至少一个非标识符列。例如,性别。
-
要进行LiveRamp 配置,请输入客户端 ID 管理器 ARN 和客户端密钥管理器 AR N。
-
对于数据暂存,请选择 Amazon S3 位置来临时存储处理数据。
您必须拥有访问 Amazon S3 数据暂存位置的权限。有关更多信息,请参阅 为创建工作流程工作角色 AWS Entity Resolution 数据匹配服务。
-
选择下一步。
-
-
对于步骤 3:指定数据输出:
-
对于数据输出目的地和格式,选择数据输出的 Amazon S3 位置,以及数据格式是标准化数据还是原始数据。
-
对于加密,如果您选择自定义加密设置,请输入AWS KMS 密钥 ARN。
-
查看LiveRamp 生成的输出。
这是生成的附加信息 LiveRamp。
-
对于数据输出,决定要包含、隐藏或掩盖哪些字段,然后根据目标采取建议的操作。
注意
如果您选择了 LiveRamp,由于 LiveRamp 隐私过滤器删除了个人身份信息 (PII),某些字段将显示输出状态为 “不可用”。
您的目标 建议的选项 包含字段 将输出状态保持为 “已包含”。 隐藏字段(从输出中排除) 选择 “输出” 字段,然后选择 “隐藏” 。 掩码字段 选择 “输出” 字段,然后选择 “哈希输出” 。 重置之前的设置 选择 重置。 -
选择下一步。
-
-
对于步骤 4:查看并创建:
-
查看您在之前的步骤中所做的选择,并在必要时进行编辑。
-
选择创建并运行。
将出现一条消息,表明匹配的工作流程已创建且作业已启动。
-
-
在匹配工作流程详细信息页面的 “指标” 选项卡上,在 “上次作业指标” 下查看以下内容:
-
任务 ID 。
-
匹配的工作流作业的状态:已排队、进行中、已完成、失败
-
工作流作业的完成时间。
-
已处理的记录数。
-
未处理的记录数。
-
生成的唯一匹配 ID 。
-
输入记录的数量。
您还可以查看任务指标,以匹配先前在作业历史记录下运行的工作流作业。
-
-
匹配的工作流程任务完成后(状态为已完成),您可以转到数据输出选项卡,然后选择您的 Amazon S3 位置来查看结果。
使用创建匹配的工作流程 TransUnion
如果您订阅了该 TransUnion 服务,则可以通过使用 TransUnion 个人和家庭电子密钥以及超过200个数据属性链接、匹配和增强存储在不同渠道中的客户相关记录来提高客户的理解。
该 TransUnion 服务提供被称为 TransUnion 个人和家庭身份证的标识符。 TransUnion 提供已知标识符(例如姓名、地址、电话号码和电子邮件地址)的 ID 分配(也称为编码)。
先决条件
在使用创建匹配的工作流程之前 LiveRamp,您必须:
-
创建架构映射。有关更多信息,请参阅 创建架构映射。
-
订阅该 TransUnion 服务
-
为 Amazon S3 数据暂存存储桶配置适当的权限,以便在其中临时写入匹配的工作流程输出
在使用创建匹配的工作流程之前 TransUnion,将以下权限添加到 S3 数据暂存存储桶。
将每个 <user input placeholder> 替换为您自己的信息。
staging-bucket |
Amazon S3 存储桶,在运行基于提供商服务的工作流程时临时存储您的数据。 |
要创建匹配的工作流程,请执行以下操作 TransUnion:
-
登录 AWS 管理控制台 并打开 AWS Entity Resolution 数据匹配服务 控制台,地址为https://console.aws.amazon.com/entityresolution/
。 -
在左侧导航窗格的 “工作流程” 下,选择 “匹配” 。
-
在匹配工作流程页面的右上角,选择创建匹配工作流程。
-
对于步骤 1:指定匹配的工作流程详细信息,请执行以下操作:
-
输入匹配的工作流程名称和可选的描述。
-
对于数据输入,选择AWS Glue 数据库AWS 区域、AWS Glue 表,然后选择相应的架构映射。
您最多可以添加 20 个数据输入。
-
默认情况下,“标准化数据” 选项处于选中状态,因此在匹配之前对数据输入进行归一化。如果您不想对数据进行标准化,请取消选择 “标准化数据” 选项。
注意
在 “创建架构映射” 中,仅以下场景支持标准化:
-
如果将以下名称子类型分组:名字、中间名、姓氏。
-
如果将以下地址子类型分组:街道地址 1 、街道地址 2:街道地址 3 名称、城市名称、州、国家/地区、邮政编码。
-
如果将以下电话子类型分组:电话号码、电话国家/地区代码。
-
-
要指定服务访问权限,请选择一个选项并采取建议的操作。
Option 推荐操作 创建并使用新的服务角色 -
AWS Entity Resolution 数据匹配服务 使用此表所需的策略创建服务角色。
-
默认服务角色名称为
entityresolution-matching-workflow-<timestamp>。 -
您必须拥有创建角色并附加策略的权限。
-
如果您的输入数据已加密,请选择 “此数据由 KMS 密钥加密” 选项。然后,输入用于解密数据输入的密AWS KMS 钥。
使用现有服务角色 -
从下拉列表中选择一个现有服务角色名称。
如果您有列出角色的权限,则会显示角色列表。
如果您没有列出角色的权限,可以输入要使用的角色的 Amazon 资源名称 (ARN)。
如果没有现有的服务角色,则使用现有服务角色选项不可用。
-
通过选择在 IAM 中查看外部链接来查看服务角色。
默认情况下, AWS Entity Resolution 数据匹配服务 不会尝试更新现有角色策略以添加必要的权限。
-
-
(可选)要为资源启用标签,请选择添加新标签,然后输入密钥和值对。
-
选择下一步。
-
-
对于步骤 2:选择匹配技术:
-
对于 “匹配方法”,选择 “提供商服务” 。
-
对于提供商服务,请选择TransUnion。
注意
确保您的数据输入文件格式和标准化符合提供商服务的准则。
-
对于数据暂存,请选择 Amazon S3 位置来临时存储处理数据。
您必须拥有访问 Amazon S3 数据暂存位置的权限。有关更多信息,请参阅 为创建工作流程工作角色 AWS Entity Resolution 数据匹配服务。
-
-
选择下一步。
-
对于步骤 3:指定数据输出:
-
对于数据输出目的地和格式,选择数据输出的 Amazon S3 位置,以及数据格式是标准化数据还是原始数据。
-
对于加密,如果您选择自定义加密设置,请输入AWS KMS 密钥 ARN。
-
查看TransUnion 生成的输出。
这是生成的附加信息 TransUnion。
-
对于数据输出,决定要包含、隐藏或掩盖哪些字段,然后根据目标采取建议的操作。
您的目标 建议的选项 包含字段 将输出状态保持为 “已包含”。 隐藏字段(从输出中排除) 选择 “输出” 字段,然后选择 “隐藏” 。 掩码字段 选择 “输出” 字段,然后选择 “哈希输出” 。 重置之前的设置 选择 重置。 -
对于系统生成的输出,查看包含的所有字段。
-
选择下一步。
-
-
对于步骤 4:查看并创建:
-
查看您在之前的步骤中所做的选择,并在必要时进行编辑。
-
选择创建并运行。
将出现一条消息,表明匹配的工作流程已创建且作业已启动。
-
-
在匹配工作流程详细信息页面的 “指标” 选项卡上,在 “上次作业指标” 下查看以下内容:
-
任务 ID 。
-
匹配的工作流作业的状态:已排队、进行中、已完成、失败
-
工作流作业的完成时间。
-
已处理的记录数。
-
未处理的记录数。
-
生成的唯一匹配 ID 。
-
输入记录的数量。
您还可以查看任务指标,以匹配先前在作业历史记录下运行的工作流作业。
-
-
匹配的工作流程任务完成后(状态为已完成),您可以转到数据输出选项卡,然后选择您的 Amazon S3 位置来查看结果。
使用 UID 2.0 创建匹配的工作流程
如果您订阅了Unified ID 2.0服务,则可以激活具有确定性身份的广告活动,并依靠与广告生态系统中许多 UID2-enabled参与者的互操作性。有关更多信息,请参阅 Unified ID 2.0 概述
Unified ID 2.0服务提供原始UID 2,用于在交易台平台中开展广告活动。UID 2.0 是使用开源框架生成的。
在一个工作流程中,您可以使用其中一个Email Address或Phone number来生成原始 UID2,但不能同时使用两者。如果两者都存在于架构映射中,则工作流程将Email
Address选择,Phone number并将是一个直通字段。要同时支持这两者,请创建一个新的架构映射,其中Phone
number已映射但Email Address未映射。然后,使用这个新的架构映射创建第二个工作流程。
注意
原始 UID2 是通过添加盐桶中的盐来生成的,盐桶大约每年旋转一次,从而使原始 UID2 也随之旋转。因此,建议你每天刷新原始 UID2。有关更多信息,请参阅 https://unifiedid.com/docs/getting-started/gs-faqs #how-often-should-uid2s-be-refresed-freshed-freshed-freshed-freshed-
先决条件
在使用 UID 2.0 创建匹配工作流程之前,您必须:
-
创建架构映射。有关更多信息,请参阅 创建架构映射。
-
订阅 UID 2.0 服务
要使用 UID 2.0 创建匹配的工作流程,请执行以下操作:
-
登录 AWS 管理控制台 并打开 AWS Entity Resolution 数据匹配服务 控制台,地址为https://console.aws.amazon.com/entityresolution/
。 -
在左侧导航窗格的 “工作流程” 下,选择 “匹配” 。
-
在匹配工作流程页面的右上角,选择创建匹配工作流程。
-
对于步骤 1:指定匹配的工作流程详细信息,请执行以下操作:
-
输入匹配的工作流程名称和可选的描述。
-
对于数据输入,选择AWS Glue 数据库AWS 区域、AWS Glue 表,然后选择相应的架构映射。
您最多可以添加 20 个数据输入。
-
保持 “标准化数据” 选项处于选中状态,以便在匹配之前对数据输入(
Email Address或Phone number)进行归一化。有关
Email Address标准化的更多信息,请参阅 UID 2.0 文档中的电子邮件地址标准化。 有关
Phone number标准化的更多信息,请参阅 UID 2.0 文档中的电话号码标准化。 -
要指定服务访问权限,请选择一个选项并采取建议的操作。
Option 推荐操作 创建并使用新的服务角色 -
AWS Entity Resolution 数据匹配服务 使用此表所需的策略创建服务角色。
-
默认服务角色名称为
entityresolution-matching-workflow-<timestamp>。 -
您必须拥有创建角色并附加策略的权限。
-
如果您的输入数据已加密,请选择 “此数据由 KMS 密钥加密” 选项。然后,输入用于解密数据输入的密AWS KMS 钥。
使用现有服务角色 -
从下拉列表中选择一个现有服务角色名称。
如果您有列出角色的权限,则会显示角色列表。
如果您没有列出角色的权限,可以输入要使用的角色的 Amazon 资源名称 (ARN)。
如果没有现有的服务角色,则使用现有服务角色选项不可用。
-
通过选择在 IAM 中查看外部链接来查看服务角色。
默认情况下, AWS Entity Resolution 数据匹配服务 不会尝试更新现有角色策略以添加必要的权限。
-
-
(可选)要为资源启用标签,请选择添加新标签,然后输入密钥和值对。
-
选择下一步。
-
-
对于步骤 2:选择匹配技术:
-
对于 “匹配方法”,选择 “提供商服务” 。
-
对于提供商服务,请选择 Unified ID 2.0 。
-
选择下一步。
-
-
对于步骤 3:指定数据输出:
-
对于数据输出目的地和格式,选择数据输出的 Amazon S3 位置,以及数据格式是标准化数据还是原始数据。
-
对于加密,如果您选择自定义加密设置,请输入AWS KMS 密钥 ARN。
-
查看 Unified ID 2.0 生成的输出。
这是 UID 2.0 生成的所有其他信息的列表
-
对于数据输出,决定要包含、隐藏或掩盖哪些字段,然后根据目标采取建议的操作。
您的目标 建议的选项 包含字段 将输出状态保持为 “已包含”。 隐藏字段(从输出中排除) 选择 “输出” 字段,然后选择 “隐藏” 。 掩码字段 选择 “输出” 字段,然后选择 “哈希输出” 。 重置之前的设置 选择 重置。 -
对于系统生成的输出,查看包含的所有字段。
-
选择下一步。
-
-
对于步骤 4:查看并创建:
-
查看您在之前的步骤中所做的选择,并在必要时进行编辑。
-
选择创建并运行。
将出现一条消息,表明匹配的工作流程已创建且作业已启动。
-
-
在匹配工作流程详细信息页面的 “指标” 选项卡上,在 “上次作业指标” 下查看以下内容:
-
任务 ID 。
-
匹配的工作流作业的状态:已排队、进行中、已完成、失败
-
工作流作业的完成时间。
-
已处理的记录数。
-
未处理的记录数。
-
生成的唯一匹配 ID 。
-
输入记录的数量。
您还可以查看任务指标,以匹配先前在作业历史记录下运行的工作流作业。
-
-
匹配的工作流程任务完成后(状态为已完成),您可以转到数据输出选项卡,然后选择您的 Amazon S3 位置来查看结果。