AI-901:Microsoft Azure AI Fundamentals Microsoft Foundry による AI ソリューションの実装 問8
Microsoft Foundry による AI ソリューションの実装/テキストと音声の AI ソリューションオンライン会議で、日本語の発話を参加者の画面に英語の字幕としてほぼリアルタイムで表示したい状況です。利用する機能として適切なものはどれですか。
当サイトのオリジナル問題(AI-901:Microsoft Azure AI Fundamentalsの出題範囲「Microsoft Foundry による AI ソリューションの実装」に対応。実際の試験問題ではありません)
- AAzure Speech の音声合成で、英語の音声を生成して再生する
- BAzure Speech の音声翻訳で、話された日本語を英語のテキストに変換する
- CAzure Language のキーフレーズ抽出で、発話から重要な語句を取り出す
- DAzure Speech の音声認識のみを使い、日本語のテキストをそのまま表示する
正解:B
解説
Azure Speech の音声翻訳は、話された音声を認識し、別の言語のテキスト(または音声)へリアルタイムに変換できます。英語の字幕を表示する要件には、翻訳後のテキストが得られるこの機能が適します。音声合成は音声を作る機能、キーフレーズ抽出は語句の抽出であり、日本語のテキストを表示するだけでは英語の字幕になりません。
選択肢ごとの解説
- A誤り。音声合成は音声を生成する機能で、字幕となる翻訳テキストは得られません。
- B正しい。音声翻訳で日本語の発話を英語のテキストに変換し、字幕として表示できます。
- C誤り。キーフレーズ抽出は重要語句を取り出すだけで、翻訳は行いません。
- D誤り。音声認識だけでは日本語のテキストにしかならず、英語への翻訳が行われません。