Le traduzioni sono generate tramite traduzione automatica. In caso di conflitto tra il contenuto di una traduzione e la versione originale in Inglese, quest'ultima prevarrà.
Personalizzazione delle risposte alle domande
Amazon Textract ti consente di personalizzare l'output della sua funzione Queries preaddestrata utilizzando adattatori. Puoi utilizzare la console Amazon Textract
Quando si crea un adattatore utilizzando la console, si caricano i propri documenti allo scopo di addestrare l'adattatore e testarne le prestazioni. È inoltre possibile aggiungere domande ai documenti e quindi annotare i documenti collegando queste domande agli elementi di risposta corretti nei documenti. Dopo aver creato un adattatore e aver annotato i documenti, è possibile addestrare l'adattatore, verificarne le prestazioni e quindi utilizzarlo per l'analisi dei documenti.
Gli adattatori sono componenti modulari che vengono aggiunti al modello di deep learning esistente di Amazon Textract, estendendone le funzionalità per le attività su cui è addestrato. Perfezionando un modello di deep learning con adattatori, puoi personalizzare l'output per le attività di analisi dei documenti relative al tuo caso d'uso specifico.
Per creare e utilizzare un adattatore, è necessario:
-
Carica documenti di esempio per la formazione
-
Designate i set di dati relativi ai treni e ai test
-
Annota i tuoi documenti con domande e risposte
-
Addestramento dell'adattatore
-
Ottieni il AdapterId
-
Usa l'adattatore quando chiami
AnalyzeDocument
Caricamento di documenti di esempio
Per addestrare l'adattatore, devi caricare una serie di documenti di esempio rappresentativi del tuo caso d'uso. Puoi caricare documenti direttamente dal tuo computer o da un bucket Amazon S3. Per ottenere i migliori risultati, fornisci il maggior numero possibile di documenti di formazione (fino a un massimo di 2.500 pagine di documenti di formazione e 1000 documenti di test). Assicurati che i documenti rappresentino tutti gli aspetti del tuo caso d'uso. È necessario caricare almeno cinque documenti di formazione e cinque documenti di test.
Designazione dei set di formazione e test
È necessario suddividere tutti i documenti in set di formazione e test. Il set di allenamento viene utilizzato per addestrare l'adattatore. L'adattatore apprende gli schemi contenuti in questi documenti annotati. Il set di test viene utilizzato per valutare le prestazioni dell'adattatore.
Per ulteriori informazioni sui dati di addestramento e test, vederePreparazione dei set di dati di addestramento e test.
Annotazione di documenti con domande e risposte
Per annotare i documenti, hai due scelte: puoi etichettare automaticamente i tuoi documenti utilizzando la funzione Query preaddestrata e quindi modificare le etichette dove necessario. In alternativa, puoi etichettare manualmente le risposte per ciascuna delle tue domande sui documenti.
Per ulteriori informazioni sulle procedure consigliate per le interrogazioni, consulta Best practice per le interrogazioni.
Addestra l'adattatore
Dopo aver annotato i dati di allenamento, è possibile avviare il processo di addestramento dell'adattatore. Amazon Textract addestra un adattatore personalizzato per i tuoi documenti. La formazione sull'adattatore richiede 2-30 ore, a seconda delle dimensioni del set di dati e della regione. AWS Al termine della formazione, è possibile visualizzare lo stato dell'allenamento nella pagina dei dettagli dell'adattatore. Se lo stato ètraining failed, consulta Eseguire il debug degli errori di formazione per eseguire il debug dell'errore.
Valuta l'adattatore
Dopo ogni ciclo di formazione sull'adattatore, esaminate le metriche delle prestazioni riportate in Console di gestione AWS per determinare quanto l'adattatore si avvicina al livello di prestazioni desiderato. È quindi possibile migliorare ulteriormente la precisione dell'adattatore per i documenti caricando un nuovo batch di documenti di formazione o esaminando le annotazioni per i documenti con punteggi di precisione bassi. Dopo aver creato una versione migliorata dell'adattatore, puoi utilizzare la AWS Console per eliminare tutte le versioni precedenti dell'adattatore che non ti servono più.
Per ulteriori informazioni sulle metriche di valutazione, consultaValutazione e miglioramento degli adattatori.
Ottieni il AdapterId
Una volta che l'adattatore è stato addestrato, puoi ottenere l'ID univoco da utilizzare con le operazioni dell'API di analisi dei documenti Amazon Textract. Recupera il AdapterId utilizzando l'operazione ListAdapterVersionsAPI o utilizzando il. Console di gestione AWS
Chiama l'operazione AnalyzeDocument API
Per applicare l'adattatore personalizzato, fornisci il relativo ID quando chiami le operazioni AnalyzeDocumento l'StartDocumentAnalysisAPI. Ciò migliora le previsioni sui tuoi documenti. Quando richiami le operazioni API, puoi utilizzare fino a un adattatore per pagina.
Dimostrazione video e tutorial