AI-103:Developing AI Apps and Agents on Azure 情報抽出ソリューションの実装 問6
情報抽出ソリューションの実装/ドキュメントからのコンテンツ抽出保険会社が、独自様式の申請書から Azure Document Intelligence のカスタム抽出モデルで項目を抽出し、基幹システムへ自動登録しています。抽出した項目のうち、自動登録してよいものと、担当者の目視確認に回すものを、機械的に振り分けたい状況です。判定に使う情報として適切なものはどれですか。
当サイトのオリジナル問題(AI-103:Developing AI Apps and Agents on Azureの出題範囲「情報抽出ソリューションの実装」に対応。実際の試験問題ではありません)
- A抽出されたフィールド値の文字数を使い、文字数が少ない項目を目視確認に回す
- B抽出されたフィールドの境界ポリゴンの面積を使い、面積が小さい項目を目視確認に回す
- C抽出結果の各フィールドに付く信頼度(confidence)を使い、しきい値を下回る項目を目視確認に回す
- D申請書のページ番号を使い、2ページ目以降にある項目を目視確認に回す
正解:C
解説
Azure Document Intelligence は、抽出した各フィールドに信頼度(confidence)を付けて返します。自動登録の基準となるしきい値を決め、それを下回るフィールドだけを目視確認へ回すと、精度と作業量のバランスを運用で調整できます。文字数・領域の面積・ページ番号は、抽出が正しいかどうかの確からしさを表す値ではありません。しきい値は実際の抽出結果を確認して決めます。
選択肢ごとの解説
- A誤り。文字数は値の長さであり、抽出が正しいかどうかの確からしさを示しません。
- B誤り。境界ポリゴンは項目の位置を示す座標で、面積の大小は抽出の確からしさとは関係がありません。
- C正しい。フィールドごとの信頼度のしきい値で、自動登録と目視確認を機械的に振り分けられます。
- D誤り。ページ番号は項目の位置にすぎず、抽出の確からしさとは関係がありません。