AI-901:Microsoft Azure AI Fundamentals Microsoft Foundry による AI ソリューションの実装 問19
Microsoft Foundry による AI ソリューションの実装/テキストと音声の AI ソリューション自社のブランドキャラクターのイメージに合った、他社と同じではない固有の声で、音声ガイダンスを読み上げさせたい状況です。声優に収録してもらった音声サンプルを使って声を作ります。Azure Speech の機能として適切なものはどれですか。
当サイトのオリジナル問題(AI-901:Microsoft Azure AI Fundamentalsの出題範囲「Microsoft Foundry による AI ソリューションの実装」に対応。実際の試験問題ではありません)
- A音声合成(テキスト読み上げ)のカスタム音声(custom voice)で、収録した音声から独自の声を学習させてデプロイする
- B標準の音声合成の音声一覧から最も近い声を選び、ブランド固有の声として利用する
- C音声認識のカスタム音声認識(custom speech)で、収録した音声から認識モデルを学習させる
- DSSML の pitch と rate の指定だけで、標準の音声を声優の声と同じ声質に一致させる
正解:A
解説
Azure Speech の音声合成(テキスト読み上げ)には、標準の音声に加えて、収録した音声データから独自の合成音声を作るカスタム音声(custom voice)があります。声優の同意の確認や収録データの準備を行い、学習した音声モデルをデプロイして使います。利用には資格や用途に基づくアクセス制限があります。標準の音声は多くの場面で十分ですが、固有の声が必要な場合には向きません。カスタム音声認識は聞き取りの精度を高める機能で、声は作りません。SSML でピッチや速度などを調整できますが、声質そのものを別の人の声にはできません。
選択肢ごとの解説
- A正しい。音声合成のカスタム音声は、収録した音声サンプルで学習して固有の声を作り、デプロイして使う機能です。
- B誤り。標準の音声は共通で提供される声です。最も近いものを選んでも、ブランド固有の声にはなりません。
- C誤り。カスタム音声認識は話された言葉を聞き取る精度を高める機能で、合成音声の声を作る機能ではありません。
- D誤り。SSML ではピッチや読み上げ速度などの調整はできますが、標準の音声の声質を特定の人物の声に一致させることはできません。