AI-901:Microsoft Azure AI Fundamentals Microsoft Foundry による AI ソリューションの実装 問21
Microsoft Foundry による AI ソリューションの実装/コンピュータービジョンと画像生成手書きで記入された申込用紙をスキャンした画像から、印刷された項目名と手書きの記入内容を文字列として読み取りたい状況です。項目ごとのスキーマ定義などは行わず、まず文字を読み取れれば十分です。Azure Vision の機能として適切なものはどれですか。
当サイトのオリジナル問題(AI-901:Microsoft Azure AI Fundamentalsの出題範囲「Microsoft Foundry による AI ソリューションの実装」に対応。実際の試験問題ではありません)
- A画像のキャプション生成で、用紙の内容を説明する文章を作る
- B画像のタグ付けで、用紙に関連する語句を取得する
- C物体検出で、用紙の中の記入欄の位置を検出する
- DOCR(Read)で、印刷された文字と手書きの文字を読み取る
正解:D
解説
画像の中の印刷文字や手書き文字をテキストとして読み取るのは、OCR(光学式文字認識)の機能で、Azure Vision の Read が該当します。Read は印刷文字と手書き文字の両方を、行や単語の位置と信頼度とともに返します。キャプション生成は画像全体を説明する文を作り、タグ付けは写っている内容を示す語句を返し、物体検出は物体の位置を示します。いずれも画像内の文字列を読み取る機能ではありません。項目名を定義してフィールドとして構造化抽出したい場合には、Content Understanding の検討が必要になります。
選択肢ごとの解説
- A誤り。キャプション生成は画像全体を説明する文を作る機能です。画像内の文字列そのものを読み取るものではありません。
- B誤り。タグ付けは画像に写っている内容を示す語句を返す機能です。画像内の文字列を読み取る機能ではありません。
- C誤り。物体検出は画像内の物体の位置を検出する機能です。記入された文字の内容を読み取ることはできません。
- D正しい。OCR(Read)は画像内の印刷文字と手書き文字をテキストとして読み取ります。