Les traductions sont fournies par des outils de traduction automatique. En cas de conflit entre le contenu d'une traduction et celui de la version originale en anglais, la version anglaise prévaudra.
Traitement asynchrone des documents
Vous pouvez utiliser Amazon Textract pour détecter et analyser du texte dans des documents multipages au format PDF ou TIFF, y compris les factures et les reçus. Le traitement de documents multipages est une opération asynchrone, utile pour le traitement de documents volumineux de plusieurs pages. Par exemple, le traitement d'un fichier PDF de plus de 1 000 pages prend beaucoup de temps, mais le traitement asynchrone permet à votre application d'effectuer d'autres tâches pendant que l'opération est terminée.
Cette section explique comment utiliser Amazon Textract pour détecter et analyser de manière asynchrone le texte d'un document de plusieurs pages ou d'une seule page. Les documents multipages doivent être au format PDF ou TIFF. Single-page les documents traités par des opérations asynchrones peuvent être au format JPEG, PNG, TIFF ou PDF.
Vous pouvez utiliser les opérations asynchrones d'Amazon Textract aux fins suivantes :
-
Détection de texte — Vous pouvez détecter des lignes et des mots sur un document de plusieurs pages. Les opérations asynchrones sont StartDocumentTextDetectionet. GetDocumentTextDetection Pour de plus amples informations, veuillez consulter Détection de texte.
-
Analyse de texte : vous pouvez identifier les relations entre le texte détecté sur un document de plusieurs pages. Les opérations asynchrones sont StartDocumentAnalysiset. GetDocumentAnalysis Pour de plus amples informations, veuillez consulter Analyse de documents.
-
Analyse des dépenses — Vous pouvez identifier les relations entre les données sur les factures et les reçus de plusieurs pages. Amazon Textract traite chaque facture ou page de reçu d'un document de plusieurs pages comme un reçu individuel ou une facture. Il ne conserve pas le contexte d'une page à l'autre d'un document de plusieurs pages. Les opérations asynchrones sont StartExpenseAnalysiset. GetExpenseAnalysis Pour de plus amples informations, veuillez consulter Analyse des factures et des reçus.
-
Analyse des documents de prêt : vous pouvez classer et analyser les documents de prêt à l'aide du flux de travail Analyze Lending, qui classe les documents, puis les envoie automatiquement à l'opération Amazon Textract appropriée pour l'extraction des informations. Vous pouvez démarrer l'analyse asynchrone des documents de prêt avec
StartLendingAnalysis, récupérer les informations extraitesGetLendingAnalysisou obtenir un résumé des informations avec.GetLendingAnalysisSummaryAnalyze Lending renvoie les informations pertinentes extraites des documents, y compris les signatures détectées. Vous pouvez également obtenir les différents types de documents contenus dans le package soumis, divisés selon les limites logiques d'un type de document donné, si vous utilisezOutputConfigcette fonctionnalité.