教育系スタートアップが、学習コンテンツをより多くのユーザーに届けるため、テキスト形式の教材を自動的に音声化して配信したいと考えています。日本語を含む複数言語・複数の声質に対応し、生成した音声ファイルをAmazon S3に保存してオーディオプレーヤーから再生できるようにしたいと考えています。このユースケースに最も適切なAWSサービスはどれですか?
Amazon Polly Amazon Pollyはテキストを自然な音声に変換するText-to-Speech(TTS)サービスです。日本語を含む多言語に対応し、複数の声質・話速を選択可能で、MP3などの形式でAmazon S3に直接出力できます。音声教材・視覚障害者向けアクセシビリティ向上・IVR(自動音声応答)システムなどに広く活用されます。 選択肢AはAmazon Transcribeはその逆でSpeech-to-Text(音声→テキスト)サービスであり、本問の要件(テキスト→音声)には合いません。 選択肢CはAmazon Translateはテキストを別の言語に翻訳するニューラル機械翻訳サービスであり、音声生成機能はありません。 選択肢DはAmazon Lexは自然言語理解(NLU)と対話管理を用いてチャットボット・会話インターフェースを構築するサービスであり、単純なテキスト→音声変換が目的ではありません。