View a markdown version of this page

Pages - Amazon Textract

기계 번역으로 제공되는 번역입니다. 제공된 번역과 원본 영어의 내용이 상충하는 경우에는 영어 버전이 우선합니다.

Pages

문서는 하나 이상의 페이지로 구성됩니다. 유형의 블록 객체PAGE는 문서의 각 페이지에 존재합니다. PAGE 블록 객체에는 문서 페이지에서 감지된 텍스트, 키-값 페어, 테이블, 쿼리 및 쿼리 결과의 하위 IDs 목록이 포함됩니다.

선, 테이블, 키-값 세트, 쿼리 및 쿼리 결과 구성 요소가 포함된 페이지를 보여주는 문서 구조 다이어그램입니다.

PAGE 블록의 JSON은 다음과 비슷합니다.

{ "Geometry": .... "Relationships": [ { "Type": "CHILD", "Ids": [ "2602b0a6-20e3-4e6e-9e46-3be57fd0844b", // Line - Hello, world. "82aedd57-187f-43dd-9eb1-4f312ca30042", // Line - How are you? "52be1777-53f7-42f6-a7cf-6d09bdc15a30", "7ca7caa6-00ef-4cda-b1aa-5571dfed1a7c" ] } ], "BlockType": "PAGE", "Id": "8136b2dc-37c1-4300-a9da-6ed8b276ea97" // Page identifier },

PDF 형식의 다중 페이지 문서와 함께 비동기 작업을 사용하는 경우 Block 객체의 Page 필드를 검사하여 블록이 있는 페이지를 확인할 수 있습니다. 스캔한 이미지(JPEG, PNG, PDF 또는 TIFF 형식의 이미지)는 이미지에 문서 페이지가 두 개 이상 있더라도 단일 페이지 문서로 간주됩니다. 비동기 작업은 스캔한 이미지에 대해 항상 1의 Page 값을 반환합니다.

총 페이지 수는의 Pages 필드에 반환됩니다DocumentMetadata. DocumentMetadata는 Amazon Textract 작업에서 반환된 각 Block 객체 목록과 함께 반환됩니다.