Les traductions sont fournies par des outils de traduction automatique. En cas de conflit entre le contenu d'une traduction et celui de la version originale en anglais, la version anglaise prévaudra.
Personnalisation de vos requêtes et réponses
Amazon Textract vous permet de personnaliser le résultat de sa fonctionnalité de requêtes préentraînée à l'aide d'adaptateurs. Vous pouvez utiliser la console Amazon Textract
Lorsque vous créez un adaptateur à l'aide de la console, vous téléchargez vos propres documents dans le but de former l'adaptateur et de tester ses performances. Vous ajoutez également des requêtes à vos documents, puis vous annotez vos documents en liant ces requêtes aux éléments de réponse appropriés dans vos documents. Une fois que vous avez créé un adaptateur et annoté vos documents, vous pouvez entraîner l'adaptateur, vérifier ses performances, puis l'utiliser lors de l'analyse de documents.
Les adaptateurs sont des composants modulaires ajoutés au modèle d'apprentissage en profondeur Amazon Textract existant afin d'étendre ses capacités aux tâches pour lesquelles il est formé. En affinant un modèle d'apprentissage profond à l'aide d'adaptateurs, vous pouvez personnaliser le résultat pour les tâches d'analyse de documents liées à votre cas d'utilisation spécifique.
Pour créer et utiliser un adaptateur, vous devez :
-
Téléchargez des exemples de documents pour la formation
-
Désignez les ensembles de données de train et de test
-
Annotez vos documents avec des requêtes et des réponses
-
Entraînez l’adaptateur
-
Obtenez le AdapterId
-
Utilisez l'adaptateur lorsque vous appelez
AnalyzeDocument
Téléchargement d'exemples de documents
Pour entraîner l'adaptateur, vous devez télécharger un ensemble d'exemples de documents représentatifs de votre cas d'utilisation. Vous pouvez télécharger des documents directement depuis votre ordinateur ou depuis un compartiment Amazon S3. Pour de meilleurs résultats, fournissez autant de documents de formation que possible (jusqu'à un maximum de 2 500 pages de documents de formation et 1 000 documents de test). Assurez-vous que les documents représentent tous les aspects de votre cas d'utilisation. Vous devez télécharger au moins cinq documents de formation et cinq documents de test.
Désignation des ensembles d'entraînement et de test
Vous devez diviser tous vos documents en ensembles de formation et de tests. Le kit d'entraînement est utilisé pour entraîner l'adaptateur. L'adaptateur apprend les modèles contenus dans ces documents annotés. Le kit de test est utilisé pour évaluer les performances de l'adaptateur.
Pour plus d'informations sur les données d'entraînement et de test, consultezPréparation des ensembles de données de formation et de test.
Annoter des documents avec des requêtes et des réponses
Lorsque vous annotez vos documents, deux choix s'offrent à vous : vous pouvez étiqueter automatiquement vos documents à l'aide de la fonction de requêtes prédéfinie, puis modifier les étiquettes si nécessaire. Vous pouvez également étiqueter manuellement les réponses pour chacune de vos requêtes documentaires.
Pour plus d'informations sur les meilleures pratiques relatives aux requêtes, consultez la section Meilleures pratiques pour les requêtes.
Entraînez l'adaptateur
Après avoir annoté les données d'entraînement, vous pouvez lancer le processus d'entraînement de votre adaptateur. Amazon Textract forme un adaptateur adapté à vos documents. La formation de l'adaptateur dure de 2 à 30 heures, selon la taille du jeu de données et la AWS région. Lorsque l'entraînement est terminé, vous pouvez consulter le statut de l'entraînement sur la page de détails de l'adaptateur. Si le statut est le castraining failed, reportez-vous Débogage des échecs d'entraînement à la section pour corriger l'échec.
Évaluez l'adaptateur
Après chaque cycle de formation sur l'adaptateur, passez en revue les indicateurs de performance du Console de gestion AWS pour déterminer dans quelle mesure l'adaptateur se rapproche du niveau de performance souhaité. Vous pouvez ensuite améliorer encore la précision de votre adaptateur pour vos documents en téléchargeant un nouveau lot de documents de formation ou en revoyant les annotations des documents dont le score de précision est faible. Après avoir créé une version améliorée de l'adaptateur, vous pouvez utiliser la AWS console pour supprimer les versions antérieures de l'adaptateur dont vous n'avez plus besoin.
Pour plus d'informations sur les métriques d'évaluation, consultezÉvaluation et amélioration de vos adaptateurs.
Obtenez le AdapterId
Une fois que l'adaptateur a été formé, vous pouvez obtenir l'identifiant unique de votre adaptateur à utiliser avec les opérations de l'API d'analyse de documents Amazon Textract. AdapterId Récupérez-les à l'aide de l'opération ListAdapterVersionsAPI ou à l'aide du Console de gestion AWS.
Appelez l'opération AnalyzeDocument API
Pour appliquer votre adaptateur personnalisé, fournissez son identifiant lorsque vous appelez les opérations de l'StartDocumentAnalysisAPI AnalyzeDocumentor. Cela améliore les prédictions sur vos documents. Lorsque vous appelez des opérations d'API, vous pouvez utiliser jusqu'à un adaptateur par page.
Démonstration vidéo et didacticiel