過去問ドリル

AI-103:Developing AI Apps and Agents on Azure 情報抽出ソリューションの実装 問6

情報抽出ソリューションの実装/ドキュメントからのコンテンツ抽出

保険会社が、独自様式の申請書から Azure Document Intelligence のカスタム抽出モデルで項目を抽出し、基幹システムへ自動登録しています。抽出した項目のうち、自動登録してよいものと、担当者の目視確認に回すものを、機械的に振り分けたい状況です。判定に使う情報として適切なものはどれですか。

当サイトのオリジナル問題(AI-103:Developing AI Apps and Agents on Azureの出題範囲「情報抽出ソリューションの実装」に対応。実際の試験問題ではありません)

正解:C

解説

Azure Document Intelligence は、抽出した各フィールドに信頼度(confidence)を付けて返します。自動登録の基準となるしきい値を決め、それを下回るフィールドだけを目視確認へ回すと、精度と作業量のバランスを運用で調整できます。文字数・領域の面積・ページ番号は、抽出が正しいかどうかの確からしさを表す値ではありません。しきい値は実際の抽出結果を確認して決めます。

選択肢ごとの解説

  • A誤り。文字数は値の長さであり、抽出が正しいかどうかの確からしさを示しません。
  • B誤り。境界ポリゴンは項目の位置を示す座標で、面積の大小は抽出の確からしさとは関係がありません。
  • C正しい。フィールドごとの信頼度のしきい値で、自動登録と目視確認を機械的に振り分けられます。
  • D誤り。ページ番号は項目の位置にすぎず、抽出の確からしさとは関係がありません。
AI-103:Developing AI Apps and Agents on Azureの問題を演習モードで解く