自2025年11月7日起,亚马逊欺诈探测器不再向新客户开放。要了解与亚马逊欺诈检测器类似的功能,请浏览亚马逊 SageMaker AutoGluon、和 AWS WAF。
本文属于机器翻译版本。若本译文内容与英语原文存在差异,则一律以英文原文为准。
准备用于存储的事件数据
Amazon Fraud Detector 内部存储的事件数据存储在Event Type资源级别。因此,来自同一事件的所有事件数据都存储在一个事件中Event Type。存储的事件随后可用于训练新模型或重新训练现有模型。使用存储的事件数据训练模型时,您可以选择指定事件的时间范围以限制训练数据集的大小。
每次您使用亚马逊欺诈探测器控制台、API 或 SendEvent API 将数据存储在亚马逊欺诈检测器中时,亚马逊欺诈检测器都会在存储数据之前验证您的数据。CreateBatchImportJob如果您的数据未通过验证,则不会存储事件数据。
使用亚马逊欺诈探测器在内部存储数据的先决条件
-
为确保您的事件数据通过验证并成功存储数据集,请确保您已使用数据模型浏览器提供的见解来准备数据集。
-
为您要使用亚马逊欺诈检测器存储的事件数据创建了事件类型。如果还没有,请按照说明创建事件类型。
智能数据验证
当您将数据集上传到亚马逊欺诈探测器控制台进行批量导入时,亚马逊欺诈探测器使用智能数据验证 (SDV) 在导入数据之前验证您的数据集。SDV 扫描上传的数据文件并识别数据缺失、格式或数据类型不正确等问题。除了验证您的数据集外,SDV 还提供验证报告,其中列出了所有已发现的问题,并建议采取哪些措施来修复影响最大的问题。SDV 发现的某些问题可能很关键,必须先解决,Amazon Fraud Detector 才能成功导入您的数据集。有关更多信息,请参阅 智能数据验证报告。
SDV 在文件级别和数据(行)级别验证您的数据集。在文件级别,SDV 会扫描您的数据文件并发现诸如文件访问权限不足、文件大小、文件格式和标题(事件元数据和事件变量)不正确等问题。在数据级别,SDV 扫描每个事件数据(行),并确定诸如不正确的数据格式、数据长度、时间戳格式和空值等问题。
智能数据验证目前仅在 Amazon Fraud Detector 控制台中可用,并且该验证在默认情况下处于启用状态。如果您不希望亚马逊欺诈探测器在导入数据集之前使用智能数据验证,请在上传数据集时关闭亚马逊欺诈检测器控制台中的验证。
使用 API 时验证存储的数据或 AWS SDK
通过SendEvent、或 CreateBatchImportJob API 操作上传事件时GetEventPrediction,亚马逊欺诈检测器会验证以下内容:
-
该事件类型的 EventIngestion 设置为 “启用”。
-
无法更新事件时间戳。具有重复事件 ID 和不同的 EVENT_TIMESTAMP 的事件将被视为错误。
-
变量名称和值与其预期格式相匹配。有关更多信息,请参阅 创建变量。
-
必需的变量使用值填充。
-
所有活动时间戳都不早于 18 个月,也不是将来的。