View a markdown version of this page

Anpassen Ihrer Query-Antworten - Amazon Textract

Die vorliegende Übersetzung wurde maschinell erstellt. Im Falle eines Konflikts oder eines Widerspruchs zwischen dieser übersetzten Fassung und der englischen Fassung (einschließlich infolge von Verzögerungen bei der Übersetzung) ist die englische Fassung maßgeblich.

Anpassen Ihrer Query-Antworten

Mit Amazon Textract können Sie die Ausgabe seiner Funktion für vortrainierte Abfragen mithilfe von Adaptern anpassen. Sie können die Amazon Textract Textract-Konsole verwenden, um einen Adapter zu erstellen. Dieser Adapter kann dann beim Aufrufen der AnalyzeDocumentStartDocumentAnalysisAND-Operationen referenziert werden.

Wenn Sie einen Adapter mithilfe der Konsole erstellen, laden Sie Ihre eigenen Dokumente hoch, um den Adapter zu trainieren und seine Leistung zu testen. Sie fügen Ihren Dokumenten auch Abfragen hinzu und versehen Ihre Dokumente anschließend mit Anmerkungen, indem Sie diese Abfragen mit den richtigen Antwortelementen in Ihren Dokumenten verknüpfen. Sobald Sie einen Adapter erstellt und Ihre Dokumente mit Anmerkungen versehen haben, können Sie den Adapter trainieren, seine Leistung überprüfen und ihn dann bei der Analyse von Dokumenten verwenden.

Adapter sind modulare Komponenten, die dem bestehenden Amazon Textract Textract-Deep-Learning-Modell hinzugefügt werden und dessen Funktionen für die Aufgaben erweitern, für die es trainiert wurde. Durch die Feinabstimmung eines Deep-Learning-Modells mit Adaptern können Sie die Ausgabe für Dokumentenanalyseaufgaben an Ihren spezifischen Anwendungsfall anpassen.

Um einen Adapter zu erstellen und zu verwenden, müssen Sie:

  • Laden Sie Musterdokumente für Schulungen hoch

  • Bestimmen Sie die Zug- und Testdatensätze

  • Kommentieren Sie Ihre Dokumente mit Fragen und Antworten

  • Trainieren des Adapters

  • Holen Sie sich das AdapterId

  • Verwenden Sie den Adapter beim Anrufen AnalyzeDocument

Beispieldokumente werden hochgeladen

Um den Adapter zu trainieren, müssen Sie eine Reihe von Beispieldokumenten hochladen, die für Ihren Anwendungsfall repräsentativ sind. Sie können Dokumente direkt von Ihrem Computer oder einem Amazon S3 S3-Bucket hochladen. Um optimale Ergebnisse zu erzielen, sollten Sie so viele Dokumente wie möglich für die Schulung bereitstellen (bis zu 2.500 Seiten Schulungsdokumente und 1000 Testdokumente). Stellen Sie sicher, dass die Dokumente alle Aspekte Ihres Anwendungsfalls abbilden. Sie müssen mindestens fünf Schulungs- und fünf Testdokumente hochladen.

Benennung von Schulungs- und Testsets

Sie müssen alle Ihre Dokumente in Schulungs- und Testsätze unterteilen. Das Trainingsset wird verwendet, um den Adapter zu trainieren. Der Adapter lernt die Muster, die in diesen kommentierten Dokumenten enthalten sind. Das Testset wird verwendet, um die Leistung des Adapters zu bewerten.

Weitere Informationen zu Trainings- und Testdaten finden Sie unterVorbereitung von Trainings- und Testdatensätzen.

Dokumente mit Fragen und Antworten kommentieren

Beim Kommentieren Ihrer Dokumente haben Sie zwei Möglichkeiten: Sie können Ihre Dokumente mithilfe der Funktion für vortrainierte Abfragen automatisch beschriften und die Beschriftungen dann bei Bedarf bearbeiten. Alternativ können Sie die Antworten für jede Ihrer Dokumentanfragen manuell kennzeichnen.

Weitere Informationen zu bewährten Methoden für Abfragen finden Sie unter Bewährte Methoden für Abfragen.

Trainieren Sie den Adapter

Nachdem Sie die Trainingsdaten mit Anmerkungen versehen haben, können Sie den Trainingsprozess für Ihren Adapter starten. Amazon Textract trainiert einen Adapter, der auf Ihre Dokumente zugeschnitten ist. Das Adaptertraining dauert je nach Größe des Datensatzes und Region 2 bis 30 Stunden. AWS Wenn das Training abgeschlossen ist, können Sie den Trainingsstatus auf der Seite mit den Adapter-Details einsehen. Wenn der Status lautettraining failed, finden Sie Informationen Debuggen von Trainingsfehlern zum Debuggen des Fehlers.

Evaluieren Sie den Adapter

Überprüfen Sie nach jeder Runde der Adapterschulung die Leistungskennzahlen im AWS-Managementkonsole , um festzustellen, wie nahe der Adapter an Ihrem gewünschten Leistungsniveau ist. Anschließend können Sie die Genauigkeit Ihres Adapters für Ihre Dokumente weiter verbessern, indem Sie einen neuen Stapel von Schulungsdokumenten hochladen oder die Anmerkungen zu Dokumenten mit niedrigen Genauigkeitswerten überprüfen. Nachdem Sie eine verbesserte Version des Adapters erstellt haben, können Sie mit der AWS Konsole alle früheren Adapterversionen löschen, die Sie nicht mehr benötigen.

Weitere Informationen zu Bewertungsmetriken finden Sie unterEvaluierung und Verbesserung Ihrer Adapter.

Holen Sie sich den AdapterId

Sobald der Adapter trainiert wurde, können Sie die eindeutige ID für Ihren Adapter abrufen, um ihn mit den Amazon Textract Textract-API-Vorgängen zur Dokumentenanalyse zu verwenden. Rufen Sie die ab, AdapterId indem Sie die ListAdapterVersionsAPI-Operation verwenden, oder indem Sie die AWS-Managementkonsole verwenden.

Rufen Sie den AnalyzeDocument API-Vorgang auf

Um Ihren benutzerdefinierten Adapter anzuwenden, geben Sie seine ID an, wenn Sie die AnalyzeDocumentoder StartDocumentAnalysisAPI-Operationen aufrufen. Dies verbessert die Prognosen für Ihre Dokumente. Beim Aufrufen von API-Operationen können Sie bis zu einen Adapter pro Seite verwenden.

Videodemonstration und Tutorial