View a markdown version of this page

請求書と領収書の分析 - Amazon Textract

翻訳は機械翻訳により提供されています。提供された翻訳内容と英語版の間で齟齬、不一致または矛盾がある場合、英語版が優先します。

請求書と領収書の分析

Amazon Textract は、ほとんどすべての請求書や領収書から、ベンダーや受信者の連絡先情報などの関連データを抽出します。テンプレートや設定は必要ありません。請求書と領収書はさまざまなレイアウトを使用することが多いため、大規模なデータを手動で抽出することは困難で時間がかかります。Amazon Textract は ML を使用して、請求書と領収書のコンテキストを理解します。請求書または受領日、請求書または受領番号、項目価格、合計金額、支払い条件などのデータが自動的に抽出されます。

Amazon Textract は、ワークフローにとって重要なベンダー名も識別しますが、明示的にラベル付けすることはできません。例えば、Amazon Textract は、明示的なキーと値のペアの組み合わせがないページの上部にあるロゴ内にのみ示されている場合でも、受信時にベンダー名を見つけることができます。

また、Amazon Textract を使用すると、同じ概念に異なる単語を使用するさまざまな領収書や請求書からの入力を簡単に統合できます。例えば、Amazon Textract は、請求書番号、請求書番号、受信番号、標準分類の出力など、さまざまなドキュメント内のフィールド名間の関係を としてマッピングしますINVOICE_RECEIPT_ID。この場合、Amazon Textract はさまざまなドキュメントタイプにわたって一貫してデータを表します。アドレスフィールドは、「receiver」、「supplier」、「vendor」、「bill to」、「ship to」、「remit to」に分類されます。経費ドキュメントにこれらのカテゴリごとに一意の値がない場合、Amazon Textract は一意の値を持つカテゴリのみを返します。

標準分類に一致しないフィールドは、 に分類されますOTHER

以下は、経費分析オペレーションでサポートされている標準フィールドのリストです。

  • 請求書受領日 — INVOICE_RECEIPT_DATE

  • 請求書受領 ID — INVOICE_RECEIPT_ID

  • 請求書納税者 ID — TAX_PAYER_ID

  • 顧客番号 — CUSTOMER_NUMBER

  • アカウント番号 — ACCOUNT_NUMBER

  • ベンダー名 — VENDOR_NAME

  • 受信者名 — RECEIVER_NAME

  • ベンダー住所 — VENDOR_ADDRESS

  • レシーバーアドレス — RECEIVER_ADDRESS

  • 注文日 — ORDER_DATE

  • 期日 — DUE_DATE

  • 配信日 — DELIVERY_DATE

  • PO 番号 — PO_NUMBER

  • 支払い条件 — PAYMENT_TERMS

  • 合計 — TOTAL

  • 支払金額 — AMOUNT_DUE

  • 支払い額 — AMOUNT_PAID

  • 小計 — SUBTOTAL

  • 税金 — TAX

  • サービス料金 — SERVICE_CHARGE

  • チップ — GRATUITY

  • 以前の残高 — PRIOR_BALANCE

  • 割引 — DISCOUNT

  • 配送料と手数料 — SHIPPING_HANDLING_CHARGE

  • ベンダー ABN 番号 — VENDOR_ABN_NUMBER

  • ベンダー GST 番号 — VENDOR_GST_NUMBER

  • ベンダー PAN 番号 — VENDOR_PAN_NUMBER

  • ベンダー VAT 番号 — VENDOR_VAT_NUMBER

  • レシーバー ABN 番号 — RECEIVER_ABN_NUMBER

  • レシーバー GST 番号 — RECEIVER_GST_NUMBER

  • レシーバー PAN 番号 — RECEIVER_PAN_NUMBER

  • 受取人の VAT 番号 — RECEIVER_VAT_NUMBER

  • ベンダーの電話番号 — VENDOR_PHONE

  • 受信者の電話番号 — RECEIVER_PHONE

  • ベンダー URL — VENDOR_URL

  • 明細項目/明細項目の説明 — ITEM

  • 明細項目/数量 — QUANTITY

  • 明細項目/合計価格 — PRICE

  • 明細項目/単価 — UNIT_PRICE

  • Line Item/ProductCode — PRODUCT_CODE

  • 住所 (請求先、配送先、送金先、サプライヤー) — ADDRESS

  • 名前 (請求先、出荷先、送金先、サプライヤー) — NAME

  • コアアドレス (ベンダー、レシーバー、請求先、配送先、送金先、サプライヤー) — ADDRESS_BLOCK

  • 住所 (ベンダー、レシーバー、請求先、配送先、送金先、サプライヤー) — STREET

  • 市区町村 (ベンダー、レシーバー、請求先、配送先、送金先、サプライヤー) — CITY

  • 状態 (ベンダー、レシーバー、請求先、出荷先、送金先、サプライヤー) — STATE

  • 国 (ベンダー、レシーバー、請求先、配送先、送金先、サプライヤー) — COUNTRY

  • 郵便番号 (ベンダー、レシーバー、請求先、配送先、送金先、サプライヤー) — ZIP_CODE

AnalyzeExpense API は、特定のドキュメントページの次の要素を返します。

  • として表されるドキュメント内の受信または請求書の数 ExpenseIndex

  • として表される個々のフィールドの標準化された名前 Type

  • ドキュメントに表示されるフィールドの実際の名前。 として表されます。 LabelDetection

  • として表される対応するフィールドの値 ValueDetection

  • として表される、送信されたドキュメント内のページ数 Pages

  • フィールド、値、または明細項目が検出されるページ番号。 PageNumber

  • ジオメトリ。境界ボックスを含み、ページ上の個々のフィールド、値、または明細項目の位置を調整します。 Geometry

  • ドキュメントで検出された各データに関連する信頼スコア。 として表されます。 Confidence

  • 購入した個々の明細項目の行全体。 として表されます。 EXPENSE_ROW

以下は、AnalyzeExpense によって処理された受信の API 出力の一部で、標準フィールド として抽出されたドキュメントの合計: 55.64 USD を示していますTOTAL。ドキュメントの実際のテキストは「合計」、信頼スコアは「97.1」、ページ番号は「1」、合計値は「55.64 USD」と表示されます。これには、境界ボックスとポリゴン座標も含まれます。

{ "Type": { "Text": "TOTAL", "Confidence": 99.94717407226562 }, "LabelDetection": { "Text": "Total:", "Geometry": { "BoundingBox": { "Width": 0.09809663146734238, "Height": 0.0234375, "Left": 0.36822840571403503, "Top": 0.8017578125 }, "Polygon": [ { "X": 0.36822840571403503, "Y": 0.8017578125 }, { "X": 0.466325044631958, "Y": 0.8017578125 }, { "X": 0.466325044631958, "Y": 0.8251953125 }, { "X": 0.36822840571403503, "Y": 0.8251953125 } ] }, "Confidence": 97.10792541503906 }, "ValueDetection": { "Text": "$55.64", "Currency": { "Code": USD } "Geometry": { "BoundingBox": { "Width": 0.10395314544439316, "Height": 0.0244140625, "Left": 0.66837477684021, "Top": 0.802734375 }, "Polygon": [ { "X": 0.66837477684021, "Y": 0.802734375 }, { "X": 0.7723279595375061, "Y": 0.802734375 }, { "X": 0.7723279595375061, "Y": 0.8271484375 }, { "X": 0.66837477684021, "Y": 0.8271484375 } ] }, "Confidence": 99.85165405273438 }, "PageNumber": 1 }

同期オペレーションを使用して、請求書または領収書を分析できます。これらのドキュメントを分析するには、AnalyzeExpense オペレーションを使用して領収書または請求書を渡します。 は結果のセット全体AnalyzeExpenseを返します。詳細については、「Amazon Textract を使用した請求書と領収書の分析」を参照してください。

請求書と受信を非同期的に分析するには、StartExpenseAnalysis を使用して入力ドキュメントファイルの処理を開始します。結果を取得するには、GetExpenseAnalysis を呼び出します。StartExpenseAnalysis への特定の呼び出しの結果は、 によって返されますGetExpenseAnalysis。詳細と例については、「ドキュメントの非同期処理」を参照してください。