View a markdown version of this page

Pagine - Amazon Textract

Le traduzioni sono generate tramite traduzione automatica. In caso di conflitto tra il contenuto di una traduzione e la versione originale in Inglese, quest'ultima prevarrà.

Pagine

Un documento è composto da una o più pagine. PAGEEsiste un oggetto Block di tipo per ogni pagina del documento. Un oggetto PAGE blocco contiene un elenco di ID secondari per le righe di testo, le coppie chiave-valore, le tabelle, le interrogazioni e i risultati delle interrogazioni rilevati nella pagina del documento.

Diagramma della struttura del documento che mostra Page contenente i componenti Line, Table, Key-Value Set, Query e Queries Result.

Il codice JSON per un PAGE blocco è simile al seguente.

{ "Geometry": .... "Relationships": [ { "Type": "CHILD", "Ids": [ "2602b0a6-20e3-4e6e-9e46-3be57fd0844b", // Line - Hello, world. "82aedd57-187f-43dd-9eb1-4f312ca30042", // Line - How are you? "52be1777-53f7-42f6-a7cf-6d09bdc15a30", "7ca7caa6-00ef-4cda-b1aa-5571dfed1a7c" ] } ], "BlockType": "PAGE", "Id": "8136b2dc-37c1-4300-a9da-6ed8b276ea97" // Page identifier },

Se utilizzi operazioni asincrone con un documento multipagina in formato PDF, puoi determinare la pagina in cui si trova un blocco esaminando il campo dell'oggetto. Page Block Un'immagine digitalizzata (un'immagine in formato JPEG, PNG, PDF o TIFF) viene considerata un documento a pagina singola, anche se l'immagine contiene più di una pagina del documento. Le operazioni asincrone restituiscono sempre il valore 1 per le immagini scansionatePage.

Il numero totale di pagine viene restituito nel campo di. Pages DocumentMetadata DocumentMetadataviene restituito con ogni elenco di Block oggetti restituiti da un'operazione Amazon Textract.