AI-103:Developing AI Apps and Agents on Azure コンピューター ビジョン ソリューションの実装 問1
コンピューター ビジョン ソリューションの実装/画像/動画生成の設計と実装通販会社が、撮影済みの商品写真について、背景の一部だけを季節の装飾に差し替え、商品本体や写り込んだ影の部分は元の画像のまま維持したい状況です。多数の写真を自動処理するアプリを Foundry 上で作ります。設計として適切なものはどれですか。
当サイトのオリジナル問題(AI-103:Developing AI Apps and Agents on Azureの出題範囲「コンピューター ビジョン ソリューションの実装」に対応。実際の試験問題ではありません)
- A元の画像、変更したい領域を示すマスク画像、変更内容を記したプロンプトを、画像編集に対応した画像生成モデルの編集機能へ送る
- B元の画像の説明文を作成し、その説明文の背景部分だけを書き換えて、画像生成モデルで毎回新規に画像を生成し直す
- CAzure Vision の物体検出で背景の領域を検出し、検出された領域の情報を指定して画像の背景を差し替える
- D画像入力に対応したマルチモーダルチャットモデルに画像と指示を送り、編集後の画像ファイルを応答として受け取る
正解:A
解説
元画像の一部だけを変更する用途には、画像編集に対応した画像生成モデルに、元画像・マスク画像(変更対象の領域)・プロンプトを渡す編集機能が適しています。マスクで編集範囲を限定できるため、商品本体を維持したまま背景だけを差し替える用途に適しています。新規生成のやり直しでは、商品の形や色が元の写真と変わってしまいます。
選択肢ごとの解説
- A正しい。マスクで変更領域を限定する画像編集の機能を使うことで、領域外を維持したまま一部だけを差し替えられます。
- B誤り。新規生成では毎回別の画像になり、商品本体や影が元の写真と同一に保たれる保証がありません。
- C誤り。Azure Vision の物体検出は領域の位置を返す分析機能で、画像を書き換える機能ではありません。
- D誤り。マルチモーダルチャットモデルは画像を入力として理解して文章で答えるもので、編集済みの画像ファイルを出力する用途のモデルではありません。