Les traductions sont fournies par des outils de traduction automatique. En cas de conflit entre le contenu d'une traduction et celui de la version originale en anglais, la version anglaise prévaudra.
CreateDatasetImportJob
Crée une tâche qui importe les données de formation depuis votre source de données (un compartiment Amazon S3) vers un ensemble de données Amazon Personalize. Pour permettre à Amazon Personalize d'importer les données de formation, vous devez spécifier un rôle de service IAM autorisé à lire à partir de la source de données, car Amazon Personalize copie vos données et les traite en interne. Pour plus d'informations sur l'octroi de l'accès à votre compartiment Amazon S3, consultez la section Donner à Amazon un accès personnalisé aux ressources Amazon S3.
Si vous avez déjà créé un outil de recommandation ou déployé une version de solution personnalisée avec une campagne, la manière dont les nouveaux enregistrements groupés influencent les recommandations dépend du cas d'utilisation du domaine ou de la recette que vous utilisez. Pour plus d'informations, consultez la section Comment les nouvelles données influencent les recommandations en temps réel.
Important
Par défaut, une tâche d'importation de jeu de données remplace toutes les données existantes du jeu de données que vous avez importé en masse. Pour ajouter de nouveaux enregistrements sans remplacer les données existantes, spécifiez INCREMENTAL pour le mode d'importation de l' CreateDatasetImportJob opération.
Statut
Une tâche d'importation de jeux de données peut se trouver dans l'un des états suivants :
-
CREATE PENDING > CREATE IN_PROGRESS > ACTIVE -ou- CREATE FAILED
Pour connaître l'état de la tâche d'importation, appelez DescribeDatasetImportJob, en fournissant le nom de ressource Amazon (ARN) de la tâche d'importation de l'ensemble de données. L'importation d'ensembles de données est terminée quand le statut ACTIVE (ACTIF) apparaît. Si l'état indique CREATE FAILED, la réponse inclut une failureReason clé qui décrit pourquoi la tâche a échoué.
Note
L'importation nécessite un certain temps. Vous devez attendre que le statut soit ACTIF avant d'entraîner un modèle à l'aide du jeu de données.
API associées
Syntaxe de la requête
{
"datasetArn": "string",
"dataSource": {
"dataLocation": "string"
},
"importMode": "string",
"jobName": "string",
"publishAttributionMetricsToS3": boolean,
"roleArn": "string",
"tags": [
{
"tagKey": "string",
"tagValue": "string"
}
]
}
Paramètres de demande
Cette demande accepte les données suivantes au format JSON.
- datasetArn
-
L'ARN du jeu de données qui reçoit les données importées.
Type : Chaîne
Contraintes de longueur : longueur maximale de 256.
Modèle :
arn:([a-z\d-]+):personalize:.*:.*:.+Obligatoire : oui
- dataSource
-
Le compartiment Amazon S3 qui contient les données d'entraînement à importer.
Type : objet DataSource
Obligatoire : oui
- importMode
-
Spécifiez comment ajouter les nouveaux enregistrements à un ensemble de données existant. Le mode d'importation par défaut est
FULL. Si vous n'avez jamais importé d'enregistrements en masse dans le jeu de données auparavant, vous pouvez uniquement spécifierFULL.-
Spécifiez
FULLde remplacer toutes les données groupées existantes dans votre jeu de données. Les données que vous avez importées individuellement ne sont pas remplacées. -
Spécifiez
INCREMENTALd'ajouter les nouveaux enregistrements aux données existantes de votre jeu de données. Amazon Personalize remplace tout enregistrement portant le même identifiant par le nouveau.
Type : Chaîne
Valeurs valides :
FULL | INCREMENTALObligatoire : non
-
- jobName
-
Le nom de la tâche d'importation de l'ensemble de données.
Type : Chaîne
Contraintes de longueur : longueur minimum de 1. Longueur maximum de 63.
Modèle :
^[a-zA-Z0-9][a-zA-Z0-9\-_]*Obligatoire : oui
- publishAttributionMetricsToS3
-
Si vous avez créé une attribution de métrique, indiquez si vous souhaitez publier des métriques pour cette tâche d'importation sur Amazon S3
Type : booléen
Obligatoire : non
- roleArn
-
L'ARN du rôle IAM autorisé à lire à partir de la source de données Amazon S3.
Type : Chaîne
Contraintes de longueur : longueur maximale de 256.
Modèle :
arn:([a-z\d-]+):iam::\d{12}:role/?[a-zA-Z_0-9+=,.@\-_/]+Obligatoire : non
-
Liste des balises à appliquer à la tâche d'importation de l'ensemble de données.
Type : tableau d’objets Tag
Membres du tableau : nombre minimum de 0 élément. Nombre maximum de 200 éléments.
Obligatoire : non
Syntaxe de la réponse
{
"datasetImportJobArn": "string"
}
Eléments de réponse
Si l’action aboutit, le service renvoie une réponse HTTP 200.
Les données suivantes sont renvoyées au format JSON par le service.
- datasetImportJobArn
-
L'ARN de la tâche d'importation du jeu de données.
Type : Chaîne
Contraintes de longueur : longueur maximale de 256.
Modèle :
arn:([a-z\d-]+):personalize:.*:.*:.+
Erreurs
- InvalidInputException
-
Fournissez une valeur valide pour le champ ou le paramètre.
Code d’état HTTP : 400
- LimitExceededException
-
La limite du nombre de requêtes par seconde a été dépassée.
Code d’état HTTP : 400
- ResourceAlreadyExistsException
-
La ressource spécifiée existe déjà.
Code d’état HTTP : 400
- ResourceInUseException
-
La ressource spécifiée est en cours d'utilisation.
Code d’état HTTP : 400
- ResourceNotFoundException
-
Impossible de trouver la ressource spécifiée.
Code d’état HTTP : 400
- TooManyTagsException
-
Vous avez dépassé le nombre maximum de balises que vous pouvez appliquer à cette ressource.
Code d’état HTTP : 400
Voir aussi
Pour plus d'informations sur l'utilisation de cette API dans l'un des AWS kits SDK spécifiques à une langue, consultez les rubriques suivantes :