View a markdown version of this page

Pagine - Amazon Textract

Le traduzioni sono generate tramite traduzione automatica. In caso di conflitto tra il contenuto di una traduzione e la versione originale in Inglese, quest'ultima prevarrà.

Pagine

Un documento è composto da una o più pagine. PAGEEsiste un oggetto Block di tipo per ogni pagina del documento. Un oggetto a PAGE blocchi contiene un elenco degli ID secondari per le righe di testo, le coppie chiave-valore, le tabelle, le interrogazioni e i risultati delle query rilevati nella pagina del documento.

Diagramma della struttura del documento che mostra la pagina contenente i componenti Line, Table, Key-Value Set, Query e Queries Result.

Il JSON di un PAGE blocco è simile al seguente.

{ "Geometry": .... "Relationships": [ { "Type": "CHILD", "Ids": [ "2602b0a6-20e3-4e6e-9e46-3be57fd0844b", // Line - Hello, world. "82aedd57-187f-43dd-9eb1-4f312ca30042", // Line - How are you? "52be1777-53f7-42f6-a7cf-6d09bdc15a30", "7ca7caa6-00ef-4cda-b1aa-5571dfed1a7c" ] } ], "BlockType": "PAGE", "Id": "8136b2dc-37c1-4300-a9da-6ed8b276ea97" // Page identifier },

Se utilizzi operazioni asincrone con un documento multipagina in formato PDF, puoi determinare la pagina in cui si trova un blocco ispezionando il campo dell'oggetto. Page Block Un'immagine scansionata (un'immagine in formato JPEG, PNG, PDF o TIFF) è considerata un documento a pagina singola, anche se nell'immagine è presente più di una pagina del documento. Le operazioni asincrone restituiscono sempre un Page valore pari a 1 per le immagini scansionate.

Il numero totale di pagine viene restituito nel campo di. Pages DocumentMetadata DocumentMetadataviene restituito con ogni elenco di Block oggetti restituito da un'operazione Amazon Textract.