View a markdown version of this page

Análisis de documentos - Amazon Textract

Las traducciones son generadas a través de traducción automática. En caso de conflicto entre la traducción y la version original de inglés, prevalecerá la version en inglés.

Análisis de documentos

Amazon Textract analiza documentos y formularios en busca de relaciones entre el texto detectado. Las operaciones de análisis de Amazon Textract devuelven 5 categorías de extracción de documentos: texto, formularios, tablas, respuestas a consultas y firmas. El análisis de las facturas y los recibos se realiza mediante un proceso diferente; para obtener más información, consulteAnálisis de facturas y recibos.

Extracción de texto

El texto sin procesar extraído de un documento. Para obtener más información, consulte Líneas y palabras de texto.

Extracción de formularios

Los datos del formulario están vinculados a elementos de texto extraídos de un documento. Amazon Textract representa los datos del formulario como pares clave-valor.

En el siguiente ejemplo, una de las líneas de texto detectadas por Amazon Textract es Name: Jane Doe. Amazon Textract también identifica una clave (Nombre:) y un valor (Jane Doe). Para obtener más información, consulte Datos de formulario (Key-valuepares).

Nombre: Jane Doe

Dirección: 123 Any Street, Anytown, EE. UU.

Fecha de nacimiento: 26-12-1980

Key-value los pares también se utilizan para representar casillas de verificación o botones de opción (botones de radio) que se extraen de los formularios.

Hombre:

Para obtener más información, consulte Elementos de selección.

Extracción de tablas

Amazon Textract puede extraer tablas, celdas de tablas, los elementos de las celdas de las tablas, títulos y pies de página de las tablas y el tipo de tabla. Amazon Textract también se puede programar para que devuelva los resultados en un archivo JSON, CSV o TXT.

Name Dirección

Ana Carolina

123 Cualquier ciudad

Para obtener más información, consulte Tablas. Los elementos de selección también se pueden extraer de las tablas. Para obtener más información, consulte Elementos de selección.

Firmas en el análisis de documentos

Amazon Textract puede detectar la ubicación de las firmas en los documentos de texto. Se devuelven como objetos geométricos con recuadros delimitadores que indican la ubicación de una firma en la página, junto con la seguridad de que la firma se encuentra en esa ubicación. Si la función de firma se utiliza sola, Amazon Textract devolverá tanto las firmas como los resultados de detección de texto estándar. La detección de firmas se puede utilizar junto con otros tipos de funciones, como formularios, tablas y consultas. Cuando se usa con formularios y tablas, las firmas se pueden detectar como parte de un par clave-valor o dentro de una celda de una tabla, respectivamente.

Consultas en el análisis de documentos

Al procesar un documento con Amazon Textract, puede añadir consultas a su análisis para especificar la información que necesita. Esto implica hacer una pregunta, como «¿Cuál es el número de seguro social del cliente?» a Amazon Textract. Amazon Textract buscará entonces la información de esa pregunta en el documento y la devolverá en una estructura de respuesta separada del resto de la información del documento. Para obtener más información sobre esta estructura de respuesta, consulte Estructuras de respuesta a consultas. Para obtener más información sobre las prácticas recomendadas para el uso de consultas, consultePrácticas recomendadas para las consultas. Las consultas se pueden procesar solas o en combinación con cualquier otraFeatureType, como tablas o formularios.

Ejemplo de consulta: ¿Cuál es el número de seguro social del cliente?

Ejemplo de respuesta: 111-xx-333

En el caso de los artículos analizados, Amazon Textract devuelve lo siguiente en varios objetos Block:

  • Las líneas y palabras del texto detectado

  • El contenido de los elementos detectados

  • La relación entre los elementos detectados

  • La página en la que se detectó el elemento

  • La ubicación del elemento en la página del documento

Consultas personalizadas

Con el análisis de documentos de Amazon Textract, puede personalizar la salida del modelo mediante adaptadores entrenados en sus propios documentos. Los adaptadores son componentes que se conectan al modelo de aprendizaje profundo preentrenado de Amazon Textract y personalizan su salida para los documentos específicos de su empresa. Puede crear un adaptador para su caso de uso específico a partir de documentos de muestra y entrenando el adaptador a partir de los ejemplos anotados. annotating/labeling

Tras crear un adaptador, Amazon Textract le proporciona un. AdapterId Puede tener varias versiones de adaptador en un solo adaptador. Puede proporcionar el AdapterId, junto con un AdapterVersion, a una operación para especificar que desea utilizar el adaptador que ha creado. Por ejemplo, proporciona los dos parámetros a la AnalyzeDocumentAPI para el análisis sincrónico de documentos o la StartDocumentAnalysisoperación para el análisis asíncrono. Si lo proporciona AdapterId como parte de la solicitud, el adaptador se integrará automáticamente en el proceso de análisis y se utilizará para mejorar las predicciones de los documentos. De esta forma, puede aprovechar las capacidades y, al AnalyzeDocument mismo tiempo, personalizar el modelo para adaptarlo a su propio caso de uso.

Para obtener más información acerca de cómo utilizar el adaptadores, consulte Personalización de las respuestas a las consultas. Para ver un tutorial sobre cómo crear, entrenar y usar adaptadores con el Consola de administración de AWS, consulteTutorial de consultas personalizadas.

Maquetación en el análisis de documentos

Amazon Textract se puede utilizar para detectar el diseño de un documento mediante la búsqueda de las ubicaciones de distintos elementos y sus líneas de texto asociadas. Estos elementos son párrafos, listas, encabezados, pies de página, números de página, figuras, tablas, títulos y encabezados de sección. Al analizar el diseño de un documento, Amazon Textract devuelve la ubicación del cuadro delimitador de los elementos del diseño, así como el texto de dichos elementos. Esta información se devuelve en el orden de lectura implícito del documento, con una lista de los elementos de arriba a abajo y de izquierda a derecha.

Puede utilizar operaciones sincrónicas o asíncronas para analizar el texto de un documento. Para analizar el texto de forma sincrónica, utilice la AnalyzeDocumentoperación y pase un documento como entrada. AnalyzeDocumentdevuelve el conjunto completo de resultados. Para obtener más información, consulte Análisis del texto de un documento con Amazon Textract.

Para detectar texto de forma asíncrona, utilice StartDocumentAnalysispara iniciar el procesamiento. Para obtener los resultados, llame. GetDocumentAnalysis Los resultados se devuelven en una o más respuestas deGetDocumentAnalysis. Para obtener más información y un ejemplo, consulte Detectar o analizar texto en un documento de varias páginas.

Para especificar el tipo de análisis que se va a realizar, puede utilizar el parámetro de entrada de la FeatureTypes lista. Agregue TABLAS a la lista para obtener información sobre las tablas detectadas en el documento de entrada, por ejemplo, las celdas de la tabla, el texto de las celdas y los elementos de selección de las celdas. Agregue FORMULARIOS para obtener relaciones entre palabras, como pares clave-valor y elementos de selección. Añada CONSULTAS para especificar la información que desea que Amazon Textract busque en el documento y obtenga una respuesta en forma de par pregunta-respuesta. Añada el diseño para determinar el diseño del documento. Para realizar todos los tipos de análisis, añada tablas, FORMULARIOS, CONSULTAS y MAQUETACIÓN aFeatureTypes.

Todas las líneas y palabras que se detectan en el documento se incluyen en la respuesta (incluido el texto no relacionado con el valor deFeatureTypes).