View a markdown version of this page

Amazon Textract とは - Amazon Textract

翻訳は機械翻訳により提供されています。提供された翻訳内容と英語版の間で齟齬、不一致または矛盾がある場合、英語版が優先します。

Amazon Textract とは

Amazon Textract は、ドキュメントテキストの検出と分析をアプリケーションに追加するのに役立ちます。Amazon Textract を使用すると、以下を実行できます。

  • 財務報告書、医療記録、納税申告書など、さまざまな文書に入力および手書きのテキストを検出します。

  • Amazon Textract ドキュメント分析 API を使用して、構造化データを含むドキュメントからテキスト、フォーム、テーブルを抽出します。

  • Amazon Textract ドキュメント分析 API 内のクエリ機能を使用して、ドキュメントから情報を指定および抽出します。

  • AnalyzeExpense API を使用して請求書と領収書を処理します。

  • AnalyzeID API を使用して、米国政府が発行した運転免許証やパスポートなどの ID ドキュメントを処理します。

  • ローン分析ワークフローを使用して、ドキュメントページを適切な Amazon Textract 分析オペレーションに自動的にルーティングして、住宅ローンパッケージをアップロードして処理します。各ドキュメントページの分析結果を取得するか、ドキュメントページのセットの要約結果を取得できます。

  • カスタムクエリを使用して、データを使用して事前トレーニング済みのクエリ機能をカスタマイズし、ダウンストリーム処理のニーズをサポートします。

Amazon Textract は、Amazon のコンピュータビジョンサイエンティストが毎日何十億もの画像や動画を分析するために開発した、実証済みの非常にスケーラブルな深層学習テクノロジーに基づいています。Amazon Textract には、イメージファイルと PDF ファイルを分析できるシンプルでeasy-to-useオペレーションが含まれているため、機械学習の専門知識は必要ありません。Amazon Textract は常に新しいデータから学習しており、Amazon はサービスに新機能を継続的に追加しています。

Amazon Textract を使用する際の一般的なユースケースは次のとおりです。

  • インテリジェント検索インデックスの作成 – Amazon Textract を使用すると、画像ファイルと PDF ファイルで検出されたテキストのライブラリを作成できます。

  • 自然言語処理 (NLP) にインテリジェントなテキスト抽出を使用する – Amazon Textract では、テキストを NLP アプリケーションの入力としてグループ化する方法を制御できます。テキストを単語と行として抽出できます。また、Amazon Textract ドキュメントテーブル分析が有効になっている場合、テーブルセルごとにテキストをグループ化します。

  • さまざまなソースからのデータのキャプチャと正規化を加速する – Amazon Textract を使用すると、財務文書、研究レポート、メディカルノートなど、さまざまなドキュメントからテキストと表形式のデータを抽出できます。Amazon Textract Analyze Document APIs を使用すると、ドキュメントから非構造化データや構造化データを簡単かつ迅速に抽出できます。

  • フォームからのデータキャプチャの自動化 – Amazon Textract を使用すると、構造化データをフォームから抽出できます。Amazon Textract Analysis APIs を使用すると、既存のビジネスワークフローに抽出機能を構築して、フォームを介して送信されたユーザーデータを使用可能な形式に抽出できます。

  • ドキュメントの分類と抽出の自動化 – Amazon Textract の Analyze Lending ドキュメント処理 API を使用すると、さまざまなドキュメントクラスへのドキュメントの貸し出しの分類を自動化し、分類されたページを自動的に正しい分析オペレーションにルーティングして、さらなる処理を行うことができます。

Amazon Textract を使用する利点には、次のようなものがあります。

  • ドキュメントテキスト検出をアプリケーションに統合 – Amazon Textract は、シンプルな API で強力かつ正確な分析を利用できるようにすることで、アプリケーションにテキスト検出機能を構築する複雑さを排除します。Amazon Textract を使用してドキュメントテキストを検出するために、コンピュータビジョンや深層学習の専門知識は必要ありません。Amazon Textract Text APIs を使用すると、任意のウェブ、モバイル、または接続されたデバイスアプリケーションにテキスト検出を簡単に構築できます。

  • スケーラブルなドキュメント分析 – Amazon Textract を使用すると、何百万ものドキュメントからデータをすばやく分析して抽出できるため、意思決定が迅速になります。

  • 低コスト – Amazon Textract では、分析したドキュメントに対してのみ料金が発生します。最低料金や前払いの義務はありません。階層型料金モデルを使用すると、無料で開始し、成長に合わせてさらに節約できます。

同期処理を使用すると、Amazon Textract はレイテンシーが重要なアプリケーションの単一ページのドキュメントを分析できます。Amazon Textract は、複数ページのドキュメントのサポートを拡張する非同期オペレーションも提供します。

Amazon Textract の API オペレーションには、それらを使用できる速度と頻度を制限するクォータがあります。アカウントに設定された制限を頻繁に超える場合は、制限の引き上げをリクエストできます。制限を変更するには、 サービスクォータ コンソールで Amazon Textract オプションを選択します。Amazon Textract コンソールのクォータ計算ツールを使用して、クォータ要件を決定できます。変更できるデフォルトのクォータの詳細については、「Amazon Textract のデフォルトのクォータに関する情報」を参照してください。

Amazon Textract でサポートされているファイルサイズや言語など、他のクォータは変更できません。設定クォータの詳細については、「Set Quotas in Amazon Textract」を参照してください。

Amazon Textract を初めて使用するユーザー

Amazon Textract を初めて使用する場合は、次のセクションを順番に読むことをお勧めします。

  1. Amazon Textract ユースケースの特定 – このセクションでは、Amazon Textract コンポーネントと、それらがどのように連携してend-to-endのエクスペリエンスを実現するかについて説明します。

  2. Amazon Textract の開始方法 – このセクションでは、アカウントを設定し、Amazon Textract API をテストします。