過去問ドリル

AI-901:Microsoft Azure AI Fundamentals Microsoft Foundry による AI ソリューションの実装 問10

Microsoft Foundry による AI ソリューションの実装/コンピュータービジョンと画像生成

ECサイトの運営者が、商品の説明文を入力すると、その説明に合った新規のイメージ画像を出力するツールを作りたい状況です。Foundry で利用するモデルとして適切なものはどれですか。

当サイトのオリジナル問題(AI-901:Microsoft Azure AI Fundamentalsの出題範囲「Microsoft Foundry による AI ソリューションの実装」に対応。実際の試験問題ではありません)

正解:D

解説

テキストの指示から新しい画像を作り出す用途には、画像生成モデルをデプロイして呼び出します。マルチモーダルのチャットモデルは画像を入力として解釈するのが主で、出力は文章です。Azure Vision の画像分析や Content Understanding のアナライザー(画像向け)は、既存の画像から情報を取り出すサービスであり、画像を新規に作る機能ではありません。

選択肢ごとの解説

  • A誤り。マルチモーダルチャットモデルは画像を解釈して文章を返すのが主な用途で、新規の画像は出力しません。
  • B誤り。画像分析は既存の画像からタグやキャプションを取り出す機能で、画像を作る機能ではありません。
  • C誤り。Content Understanding は既存のコンテンツから情報を抽出するサービスで、画像を生成しません。
  • D正しい。画像生成モデルが、テキストの説明から新規の画像を出力します。
AI-901:Microsoft Azure AI Fundamentalsの問題を演習モードで解く