View a markdown version of this page

ドキュメントの分析 - Amazon Textract

翻訳は機械翻訳により提供されています。提供された翻訳内容と英語版の間で齟齬、不一致または矛盾がある場合、英語版が優先します。

ドキュメントの分析

Amazon Textract は、検出されたテキスト間の関係についてドキュメントとフォームを分析します。Amazon Textract 分析オペレーションは、テキスト、フォーム、テーブル、クエリレスポンス、署名の 5 つのカテゴリのドキュメント抽出を返します。請求書と領収書の分析は、別のプロセスで処理されます。詳細については、「」を参照してください請求書と領収書の分析

テキスト抽出

ドキュメントから抽出された未加工のテキスト。詳細については、「テキストの行と単語」を参照してください。

フォームの抽出

フォームデータは、ドキュメントから抽出されたテキスト項目にリンクされます。Amazon Textract は、フォームデータをキーと値のペアとして表します。

次の例では、Amazon Textract によって検出されたテキスト行の 1 つが名前: Jane Doe です。Amazon Textract は、キー (名前:) と値 (Jane Doe) も識別します。詳細については、「フォームデータ (キーと値のペア)」を参照してください。

名前: Jane Doe

住所: 123 Any Street, Anytown, USA

生年月日: 12-26-1980

キーと値のペアは、フォームから抽出されたチェックボックスまたはオプションボタン (ラジオボタン) を表すためにも使用されます。

男性:

詳細については、「選択要素」を参照してください。

テーブルの抽出

Amazon Textract は、テーブル、テーブルセル、テーブルセル内の項目、テーブルのタイトルとフッター、テーブルのタイプを抽出できます。Amazon Textract は、結果を JSON、CSV、または TXT ファイルで返すようにプログラムすることもできます。

名前 Address

アナカロライナ

123 任意の町

詳細については、テーブルを参照してください。選択要素はテーブルから抽出することもできます。詳細については、「選択要素」を参照してください。

ドキュメント分析の署名

Amazon Textract は、テキストドキュメントの署名の場所を検出できます。これらは、ページ上の署名の場所と、署名がその場所にあるという信頼を提供する境界ボックスを持つジオメトリオブジェクトとして返されます。署名機能が単独で使用されている場合、Amazon Textract は署名と標準テキスト検出結果の両方を返します。署名検出は、フォーム、テーブル、クエリなどの他の機能タイプと組み合わせて使用できます。フォームとテーブルで使用する場合、署名はキーと値のペアの一部として、またはテーブルセル内でそれぞれ検出できます。

ドキュメント分析のクエリ

Amazon Textract でドキュメントを処理するときは、分析にクエリを追加して、必要な情報を指定できます。これには、「顧客の社会保障番号は何ですか?」などの質問を渡すことが含まれます。Amazon Textract へ。その後、Amazon Textract はその質問のドキュメント内の情報を検索し、ドキュメントの残りの情報とは別のレスポンス構造で返します。このレスポンス構造の詳細については、「クエリレスポンス構造」を参照してください。クエリ使用のベストプラクティスの詳細については、「」を参照してくださいクエリのベストプラクティス。クエリは、単独で処理することも、テーブルやフォームFeatureTypeなどの他の と組み合わせて処理することもできます。

クエリの例: 顧客の SSN とは何ですか?

回答例: 111-xx-333

分析された項目の場合、Amazon Textract は複数のブロックオブジェクトで以下を返します。

  • 検出されたテキストの行と単語

  • 検出された項目の内容

  • 検出された項目間の関係

  • 項目が検出されたページ

  • ドキュメントページの項目の場所

カスタムクエリ

Amazon Textract ドキュメント分析を使用すると、独自のドキュメントでトレーニングされたアダプターを使用してモデル出力をカスタマイズできます。アダプターは、Amazon Textract の事前トレーニング済みの深層学習モデルに接続し、ビジネス固有のドキュメントの出力をカスタマイズするコンポーネントです。特定のユースケース用のアダプターを作成するには、サンプルドキュメントに注釈/ラベルを付け、注釈付きのサンプルでアダプターをトレーニングします。

アダプターを作成すると、Amazon Textract は AdapterId を提供します。1 つのアダプター内に複数のアダプターバージョンを含めることができます。AdapterId と AdapterVersion を オペレーションに提供して、作成したアダプターを使用するように指定できます。たとえば、同期ドキュメント分析の場合は AnalyzeDocument API に、非同期分析の場合は StartDocumentAnalysis オペレーションに 2 つのパラメータを指定します。AdapterId をリクエストの一部として指定すると、アダプターが分析プロセスに自動的に統合され、それを使用してドキュメントの予測が強化されます。これにより、AnalyzeDocument の機能を活用しながら、独自のユースケースに合わせてモデルをカスタマイズできます。

アダプターの作成および使用に関する詳細は、「クエリレスポンスのカスタマイズ」を参照してください。でアダプターを作成、トレーニング、使用する方法のチュートリアルについては、 AWS マネジメントコンソール「」を参照してくださいカスタムクエリのチュートリアル

ドキュメント分析のレイアウト

Amazon Textract は、さまざまな要素の場所と関連するテキスト行を検索することで、ドキュメントのレイアウトを検出するために使用できます。これらの要素は、段落、リスト、ヘッダー、フッター、ページ番号、図、表、タイトル、セクションヘッダーです。ドキュメントのレイアウトを分析すると、Amazon Textract はレイアウト要素とそれらの要素のテキストの境界ボックスの場所を返します。この情報は、ドキュメントの暗黙的な読み取り順序で返され、要素を左上から右下に一覧表示します。

同期オペレーションまたは非同期オペレーションを使用して、ドキュメント内のテキストを分析できます。テキストを同期的に分析するには、AnalyzeDocument オペレーションを使用してドキュメントを入力として渡します。 は結果のセット全体AnalyzeDocumentを返します。詳細については、「Amazon Textract を使用したドキュメントテキストの分析」を参照してください。

テキストを非同期的に検出するには、StartDocumentAnalysis を使用して処理を開始します。結果を取得するには、GetDocumentAnalysis を呼び出します。結果は、 からの 1 つ以上のレスポンスで返されますGetDocumentAnalysis。詳細と例については、「マルチページドキュメント内のテキストの検出または分析」を参照してください。

実行する分析のタイプを指定するには、FeatureTypeslist input パラメータを使用できます。TABLES をリストに追加して、テーブルセル、セルテキスト、セルの選択要素など、入力ドキュメントで検出されたテーブルに関する情報を返します。FORMS を追加して、キーと値のペアや選択要素などの単語の関係を返します。QUERIES を追加して、Amazon Textract がドキュメントで検索する情報を指定し、質問と回答のペアの形式でレスポンスを返します。LAYOUT を追加して、ドキュメントのレイアウトを決定します。すべてのタイプの分析を実行するには、TABLES、FORMS、QUERIES、LAYOUT を に追加しますFeatureTypes

ドキュメントで検出されたすべての行と単語は、レスポンスに含まれます ( の値に関連しないテキストを含むFeatureTypes)。