View a markdown version of this page

Personalización de las respuestas a las consultas - Amazon Textract

Las traducciones son generadas a través de traducción automática. En caso de conflicto entre la traducción y la version original de inglés, prevalecerá la version en inglés.

Personalización de las respuestas a las consultas

Amazon Textract le permite personalizar el resultado de su función de consultas previamente entrenadas mediante adaptadores. Puede utilizar la consola Amazon Textract para crear un adaptador. A continuación, se puede hacer referencia a este adaptador al llamar a las StartDocumentAnalysisoperaciones AnalyzeDocumenty.

Cuando crea un adaptador mediante la consola, carga sus propios documentos con el fin de entrenar el adaptador y probar su rendimiento. También agrega consultas a los documentos y, a continuación, anota los documentos vinculando estas consultas a los elementos de respuesta correctos de los documentos. Una vez creado un adaptador y anotado los documentos, puede entrenarlo, comprobar su rendimiento y, a continuación, utilizarlo para analizar documentos.

Los adaptadores son componentes modulares que se añaden al modelo de aprendizaje profundo Amazon Textract existente, lo que amplía sus capacidades para las tareas en las que está entrenado. Al ajustar un modelo de aprendizaje profundo con adaptadores, puede personalizar el resultado para las tareas de análisis de documentos relacionadas con su caso de uso específico.

Para crear y usar un adaptador, debe:

  • Cargue documentos de muestra para la formación

  • Designe los conjuntos de datos del tren y de las pruebas

  • Anota tus documentos con consultas y respuestas

  • Entrenamiento del adaptador

  • Obtenga el AdapterId

  • Usa el adaptador cuando llames AnalyzeDocument

Carga de documentos de muestra

Para capacitar al adaptador, debe cargar un conjunto de documentos de muestra representativos de su caso de uso. Puede cargar documentos directamente desde su ordenador o desde un bucket de Amazon S3. Para obtener los mejores resultados, proporcione tantos documentos de formación como sea posible (hasta un máximo de 2500 páginas de documentos de formación y 1000 documentos de prueba). Asegúrese de que los documentos representen todos los aspectos de su caso de uso. Debe cargar un mínimo de cinco documentos de formación y cinco documentos de prueba.

Designación de conjuntos de entrenamiento y pruebas

Debe dividir todos sus documentos en conjuntos de entrenamiento y pruebas. El conjunto de entrenamiento se utiliza para entrenar el adaptador. El adaptador aprende los patrones contenidos en estos documentos anotados. El conjunto de prueba se utiliza para evaluar el rendimiento del adaptador.

Para obtener más información sobre los datos de entrenamiento y pruebas, consultePreparar conjuntos de datos de entrenamiento y prueba.

Anotar documentos con consultas y respuestas

Al anotar sus documentos, tiene dos opciones: puede etiquetar automáticamente sus documentos mediante la función de consultas previamente entrenada y, a continuación, editar las etiquetas cuando sea necesario. Como alternativa, puedes etiquetar manualmente las respuestas para cada una de tus consultas de documentos.

Para obtener más información sobre las prácticas recomendadas para las consultas, consulte Prácticas recomendadas para las consultas.

Entrene al adaptador

Tras anotar los datos de entrenamiento, puede iniciar el proceso de entrenamiento del adaptador. Amazon Textract entrena un adaptador que se adapta a tus documentos. La formación sobre el adaptador dura de 2 a 30 horas, según el tamaño del conjunto de datos y la AWS región. Cuando se complete el entrenamiento, puedes ver el estado del entrenamiento en la página de detalles del adaptador. Si el estado estraining failed, consulte Depuración de errores de entrenamiento para depurar el error.

Evalúe el adaptador

Después de cada ronda de formación sobre el adaptador, revise las métricas de rendimiento del adaptador Consola de administración de AWS para determinar qué tan cerca está el adaptador del nivel de rendimiento deseado. A continuación, puede mejorar aún más la precisión del adaptador para sus documentos cargando un nuevo lote de documentos de formación o revisando las anotaciones de los documentos con puntuaciones de precisión bajas. Tras crear una versión mejorada del adaptador, puede utilizar la AWS consola para eliminar las versiones anteriores del adaptador que ya no necesite.

Para obtener más información sobre las métricas de evaluación, consulteEvaluación y mejora de sus adaptadores.

Obtenga el AdapterId

Una vez que se haya entrenado el adaptador, puede obtener el identificador único para usarlo con las operaciones de la API de análisis de documentos de Amazon Textract. AdapterId Recupérelo mediante la operación de ListAdapterVersionsAPI o mediante el Consola de administración de AWS.

Llame a la operación AnalyzeDocument de la API

Para aplicar tu adaptador personalizado, proporciona su ID cuando llames a las AnalyzeDocumentoperaciones de la StartDocumentAnalysisAPI. Esto mejora las predicciones en sus documentos. Al llamar a las operaciones de la API, puede utilizar hasta un adaptador por página.

Vídeo de demostración y tutorial