AI-901:Microsoft Azure AI Fundamentals Microsoft Foundry による AI ソリューションの実装 問10
Microsoft Foundry による AI ソリューションの実装/コンピュータービジョンと画像生成ECサイトの運営者が、商品の説明文を入力すると、その説明に合った新規のイメージ画像を出力するツールを作りたい状況です。Foundry で利用するモデルとして適切なものはどれですか。
当サイトのオリジナル問題(AI-901:Microsoft Azure AI Fundamentalsの出題範囲「Microsoft Foundry による AI ソリューションの実装」に対応。実際の試験問題ではありません)
- A画像入力に対応したマルチモーダルチャットモデルに説明文を送り、画像の内容を文章で返させる
- BAzure Vision の画像分析を呼び出し、説明文に対するタグを取得する
- CAzure Content Understanding のアナライザー(画像向け)で説明文からフィールドを抽出する
- Dテキストの指示から画像を出力する画像生成モデルをデプロイして呼び出す
正解:D
解説
テキストの指示から新しい画像を作り出す用途には、画像生成モデルをデプロイして呼び出します。マルチモーダルのチャットモデルは画像を入力として解釈するのが主で、出力は文章です。Azure Vision の画像分析や Content Understanding のアナライザー(画像向け)は、既存の画像から情報を取り出すサービスであり、画像を新規に作る機能ではありません。
選択肢ごとの解説
- A誤り。マルチモーダルチャットモデルは画像を解釈して文章を返すのが主な用途で、新規の画像は出力しません。
- B誤り。画像分析は既存の画像からタグやキャプションを取り出す機能で、画像を作る機能ではありません。
- C誤り。Content Understanding は既存のコンテンツから情報を抽出するサービスで、画像を生成しません。
- D正しい。画像生成モデルが、テキストの説明から新規の画像を出力します。