View a markdown version of this page

Antwortobjekte für Texterkennung und Dokumentenanalyse - Amazon Textract

Die vorliegende Übersetzung wurde maschinell erstellt. Im Falle eines Konflikts oder eines Widerspruchs zwischen dieser übersetzten Fassung und der englischen Fassung (einschließlich infolge von Verzögerungen bei der Übersetzung) ist die englische Fassung maßgeblich.

Antwortobjekte für Texterkennung und Dokumentenanalyse

Wenn Amazon Textract ein Dokument verarbeitet, erstellt es eine Liste von Blockobjekten für den erkannten oder analysierten Text. Jeder Block enthält Informationen über einen erkannten Artikel, seinen Standort und das Vertrauen, das Amazon Textract in die Genauigkeit der Verarbeitung hat.

Ein Dokument besteht aus den folgenden Block Objekttypen.

Der Inhalt eines Blocks hängt von der Operation ab, die Sie aufrufen. Wenn Sie eine der Texterkennungsoperationen aufrufen, werden die Seiten, Zeilen und Wörter des erkannten Texts zurückgegeben. Weitere Informationen finden Sie unter Erkennen von Text. Wenn Sie eine der Operationen zur Dokumentenanalyse aufrufen, werden Informationen zu erkannten Seiten, Schlüssel-Wert-Paaren, Tabellen, Auswahlelementen und Text zurückgegeben. Weitere Informationen finden Sie unter Dokumente werden analysiert.

Einige Block Objektfelder sind beiden Verarbeitungsarten gemeinsam. Beispielsweise hat jeder Block eine eindeutige Kennung.

Beispiele, die zeigen, wie Block Objekte verwendet werden, finden Sie unterLernprogramme.

Layout des Dokuments

Amazon Textract gibt eine Darstellung eines Dokuments als Liste verschiedener Block Objekttypen zurück, die in einer Eltern-Kind-Beziehung oder als Schlüssel-Wert-Paar verknüpft sind. Metadaten, die die Anzahl der Seiten in einem Dokument angeben, werden ebenfalls zurückgegeben. Im Folgenden finden Sie den JSON-Code für ein typisches Block Objekt des TypsPAGE.

{ "Blocks": [ { "Geometry": { "BoundingBox": { "Width": 1.0, "Top": 0.0, "Left": 0.0, "Height": 1.0 }, "Polygon": [ { "Y": 0.0, "X": 0.0 }, { "Y": 0.0, "X": 1.0 }, { "Y": 1.0, "X": 1.0 }, { "Y": 1.0, "X": 0.0 } ] }, "Relationships": [ { "Type": "CHILD", "Ids": [ "2602b0a6-20e3-4e6e-9e46-3be57fd0844b", "82aedd57-187f-43dd-9eb1-4f312ca30042", "52be1777-53f7-42f6-a7cf-6d09bdc15a30", "7ca7caa6-00ef-4cda-b1aa-5571dfed1a7c" ] } ], "BlockType": "PAGE", "Id": "8136b2dc-37c1-4300-a9da-6ed8b276ea97" }..... ], "DocumentMetadata": { "Pages": 1 } }

Ein Dokument besteht aus einem oder mehreren PAGE Blöcken. Jede Seite enthält eine Liste von untergeordneten Blöcken für die wichtigsten Elemente, die auf der Seite erkannt wurden, wie Textzeilen und Tabellen. Weitere Informationen finden Sie unter Seiten.

Sie können den Typ eines Block Objekts bestimmen, indem Sie das BlockType Feld überprüfen.

Ein Block Objekt enthält eine Liste verwandter Block Objekte in dem Relationships Feld, bei der es sich um eine Reihe von Beziehungsobjekten handelt. Ein Relationships Array ist entweder vom Typ CHILD oder vom Typ VALUE. Ein Array vom Typ CHILD wird verwendet, um die Elemente aufzulisten, die dem aktuellen Block untergeordnet sind. Wenn der aktuelle Block beispielsweise vom Typ LINE ist, Relationships enthält er eine Liste von IDs für die WORD-Blöcke, aus denen die Textzeile besteht. Ein Array vom Typ VALUE wird verwendet, um Schlüssel-Wert-Paare zu enthalten. Sie können den Typ der Beziehung bestimmen, indem Sie das Type Feld des Objekts untersuchen. Relationship

Untergeordnete Blöcke enthalten keine Informationen über ihre übergeordneten Blockobjekte.

Beispiele mit Block Informationen finden Sie unterDokumente synchron verarbeiten.

Wahrscheinlichkeit

Amazon Textract-Operationen geben das prozentuale Vertrauen zurück, das Amazon Textract in die Genauigkeit des erkannten Elements hat. Verwenden Sie das Confidence Feld des Objekts, um dieses Vertrauen zu erlangen. Block Ein höherer Wert steht für ein höheres Konfidenzniveau. Je nach Szenario müssen Erkennungen mit geringer Zuverlässigkeit möglicherweise visuell von einem Menschen bestätigt werden.

Geometry

Amazon Textract Textract-Operationen (mit Ausnahme der Identitätsanalyse) geben Standortinformationen über den Standort erkannter Artikel auf einer Dokumentseite zurück. Verwenden Sie das Geometry Feld des Block Objekts, um den Standort abzurufen. Weitere Informationen finden Sie unter Suchen nach Elementen auf einer Dokumentseite.