過去問ドリル

AI-901:Microsoft Azure AI Fundamentals Microsoft Foundry による AI ソリューションの実装 問22

Microsoft Foundry による AI ソリューションの実装/コンピュータービジョンと画像生成

フリマアプリの開発チームが、次の2つの機能を実装します。(1) 出品者が投稿した商品写真の内容を説明する代替テキストを文章で作る。(2) 季節のキャンペーン用に、テキストの指示から新規のイメージ画像を作る。Foundry にデプロイするモデルの割り当てとして適切なものはどれですか。

当サイトのオリジナル問題(AI-901:Microsoft Azure AI Fundamentalsの出題範囲「Microsoft Foundry による AI ソリューションの実装」に対応。実際の試験問題ではありません)

正解:C

解説

既存の画像の内容を解釈して文章で答える用途には、画像入力に対応したマルチモーダルチャットモデルを使います。一方、テキストの指示から新しい画像を出力する用途には、画像生成モデルを使います。したがって、(1) はマルチモーダルチャットモデル、(2) は画像生成モデルの組み合わせが適切です。画像生成モデルは画像を出力するモデルで、写真を読み取って文章で説明する用途のためのものではありません。画像入力に対応したチャットモデルは主に文章を出力し、新しい画像を出力する用途には使いません。

選択肢ごとの解説

  • A誤り。割り当てが逆です。写真の説明文を作るのはマルチモーダルチャットモデル、新規画像を作るのは画像生成モデルです。
  • B誤り。画像生成モデルは画像を出力するためのモデルです。(1) の写真の内容を文章で説明する用途には向きません。
  • C正しい。写真の内容を文章で説明するのはマルチモーダルチャットモデル、テキストの指示から新規画像を作るのは画像生成モデルです。
  • D誤り。画像入力に対応したチャットモデルは主に文章を出力するため、(2) のテキストの指示から新規画像を作る用途には使いません。
AI-901:Microsoft Azure AI Fundamentalsの問題を演習モードで解く