Instiq
第5章 · Azure Content Understanding による情報抽出·v1.1.0·更新 2026/6/11·読了目安 約12分

変更要約: 各節に図(figure)を追加=cert-figure-retrofit。AI-901 第5章を新規作成(ドメイン2: Content Understanding=多モーダル情報抽出(文書/フォーム/画像/音声/動画→構造化)、スキーマ/フィールド定義、prebuilt vs custom、Document Intelligence/Vision/Speech との位置づけ、構築の流れ=アナライザー→スキーマ→解析→結果、RAG/エージェントとの連携)

5.2情報抽出アプリを構築する

この節の要点

Content Understanding を使って軽量な情報抽出アプリを作る流れ(アナライザーの作成→スキーマ定義→入力を解析→構造化結果を受け取る)と、Foundry や SDK との組み合わせ、典型的なユースケースを理解します。

情報抽出アプリ作りの基本は「
①アナライザーを作る →
②抽出スキーマ(フィールド)を定義する →
③ファイルを解析させる →
④構造化された結果を受け取る」という流れです。アナライザー(analyzer)は「どの種類のコンテンツを・どのスキーマで抽出するか」をまとめた設定で、これにファイルを渡すと、各フィールドが埋まった結果(JSON など)が返ります。Foundry のポータルでスキーマを設計・試行し、アプリからは SDK で解析を呼び出す、という組み合わせが一般的です。

5.2.1構築の流れ

ステップ内容
1. アナライザー作成対象コンテンツ種別に合わせて作成
2. スキーマ定義抽出したいフィールド(名前・型)を指定
3. 解析ファイルを渡して解析を実行
4. 結果取得各フィールドが埋まった構造化データを受領

5.2.2Foundry・生成 AI・エージェントとの組み合わせ

情報抽出は単体でも有用ですが、他のワークロードと連携するとさらに力を発揮します。抽出した構造化データを グラウンディング(RAG)の根拠として生成 AI に渡せば、ファイルの中身に基づく回答ができます。また エージェント のツールの1つとして情報抽出を組み込めば、「書類を読み取って→内容を判断して→次の処理を実行」という自律フローが作れます。第2〜4章で学んだ Foundry のモデル・グラウンディング・エージェントと、この情報抽出が結びつく、という全体像を押さえましょう。

続きは無料登録で読めます

冒頭を無料で公開中。無料登録でこの節の全文と、第4章以降を含む全参考書・全問題集が読めます。