過去問ドリル

AI-901:Microsoft Azure AI Fundamentals Microsoft Foundry による AI ソリューションの実装 問11

Microsoft Foundry による AI ソリューションの実装/コンピュータービジョンと画像生成

フリマアプリで、出品者が投稿した写真に対して、定型的なキャプションとタグ、および写真に写っている文字列を取得して一覧画面に表示したい状況です。生成AIモデルへのプロンプト設計は行わない方針です。利用する機能として適切なものはどれですか。

当サイトのオリジナル問題(AI-901:Microsoft Azure AI Fundamentalsの出題範囲「Microsoft Foundry による AI ソリューションの実装」に対応。実際の試験問題ではありません)

正解:A

解説

Azure Vision の画像分析は、画像に対してキャプションやタグを返し、画像内の文字も読み取れるため、アプリへの視覚機能の組み込みに適しています。プロンプトを設計せず API を呼ぶだけで、定型的な結果が得られます。画像生成モデルは画像を新規に作るもので、Azure Language はテキストを、Azure Speech は音声を入力とするサービスのため、写真は直接処理できません。なお Azure Vision の Image Analysis 4.0 は将来の提供終了が公表されているため、新規設計では最新の提供状況を確認してください。

選択肢ごとの解説

  • A正しい。画像分析でキャプション、タグ、画像内の文字の読み取りを API として呼び出せます。
  • B誤り。画像生成モデルは新しい画像を作る用途で、写真から情報を取り出す目的には合いません。
  • C誤り。Azure Language の入力はテキストであり、写真を直接入力することはできません。
  • D誤り。Azure Speech の音声認識は音声が対象で、写真を処理できません。
AI-901:Microsoft Azure AI Fundamentalsの問題を演習モードで解く