Die vorliegende Übersetzung wurde maschinell erstellt. Im Falle eines Konflikts oder eines Widerspruchs zwischen dieser übersetzten Fassung und der englischen Fassung (einschließlich infolge von Verzögerungen bei der Übersetzung) ist die englische Fassung maßgeblich.
Bewährte Methoden für benutzerdefinierte Amazon Textract Textract-Abfragen
Mit Amazon Textract können Sie die Ausgabe seiner Funktion für vortrainierte Abfragen anpassen, indem Sie einen Adapter für das Basismodell trainieren und verwenden. Mit Amazon Textract Custom Queries können Sie Ihre eigenen Dokumente verwenden und einem Adapter beibringen, das Basismodell anzupassen, während Sie gleichzeitig die Kontrolle über Ihre eigenen Dokumente behalten. Verwenden Sie beim Erstellen von Abfragen für Ihre Adapter die folgenden bewährten Methoden. Weitere Informationen zu Adaptern finden Sie unterAnpassen Ihrer Query-Antworten.
-
Die Beispieldaten sollten Layout- und Bildvariationen enthalten, die repräsentativ für die Dokumente sind, die in der Produktion verwendet werden sollen.
-
Für Schulungen oder Tests sind mindestens fünf Stichproben (pro Abfrageebene) erforderlich. Je mehr Stichproben für das Training verwendet werden, desto besser.
-
Die kommentierten Abfragen sollten eine Vielzahl von Antworten haben. Lautet die Antwort auf eine Anfrage beispielsweise „Ja“ oder „Nein“, sollten in den mit Anmerkungen versehenen Stichproben sowohl „Ja“ als auch „Nein“ vorkommen
-
Verfasste Abfragen sollten logische Bedeutungen und Strukturen haben. Um beispielsweise den Namen eines Zahlungsempfängers auf dem Scheck zu extrahieren, sollte die Abfrage „Wer ist der Zahlungsempfänger?“ lauten und nicht „Wie lautet der Name?“.
-
Wenn einem Wert, der extrahiert werden muss, ein Schlüssel zugeordnet ist, fügen Sie den Schlüssel in die Abfrage ein, um bessere Ergebnisse zu erzielen. Wenn Schlüssel mehrfach vorkommen, verwenden Sie hierarchische Fragen wie „Wie lautet der Vorname unter Kreditnehmer?“ und „Was ist der Vorname unter Mitkreditnehmer?“
-
Achten Sie auf Konsistenz im Annotationsstil. Wenn ein Feld an mehreren Stellen in einem Dokument erscheint und Sie beschließen, nur ein Vorkommen mit Anmerkungen zu versehen, folgen Sie derselben Richtlinie und fügen Sie in allen Dokumenten nur ein Vorkommen mit Anmerkungen hinzu. Wenn Sie sich jedoch dafür entscheiden, alle Vorkommen eines Werts mit Anmerkungen zu versehen, gehen Sie für alle Dokumente genauso vor.
-
Achten Sie bei der Kommentierung von Feldern mit Leerzeichen auf Konsistenz. Wenn der Wert eines Felds „123 456 78“ lautet und Sie es als „12345678“ annotieren möchten, befolgen Sie für alle Dokumente dieselbe Richtlinie. Wechseln Sie nicht zwischen der Anmerkung des Werts „123 456 78“ und „12345678“.
-
Kommentieren Sie die Daten auf allen Seiten innerhalb eines Dokuments, auch wenn Sie möglicherweise nur auf einigen Seiten Rückschlüsse ziehen. Wenn es nicht möglich ist, alle Seiten mit Anmerkungen zu versehen, teilen Sie das Dokument auf und verwenden Sie in Ihrem Datensatz nur die Seiten, die Sie mit Anmerkungen versehen können.
-
Benutzerdefinierte Abfragen unterstützen keine Fragen im Zusammenhang mit Signaturen (z. B. „Ist das Dokument signiert?“). Um zu erfahren, ob ein Dokument signiert ist, verwenden Sie die Signaturfunktion in Ihrer API-Anfrage.
-
Bei der Korrektur von Antworten aus der Vorbeschriftung können Sie kleine Änderungen am Text in den Dokumenten vornehmen, z. B. einige Zeichenfehler korrigieren oder Leerzeichen und Satzzeichen entfernen. Wenn Text in den Dokumenten jedoch nicht angezeigt wird, geben Sie ihn nicht als Antwort ein.
-
Verwenden Sie genau die Abfrage, die im Training verwendet wurde, um Rückschlüsse zu ziehen.
-
Geben Sie die Ergebnisse der Vorbeschriftung nur für die Seite an
source-ref. Wenn du Ergebnisse mit Blöcken hast, die nicht von dersource-refSeite stammen, kann sich das auf die Leistung auswirken.