スポンサーリンク

問題の解答・解説ページ

このページは解説の閲覧モードです。
実力試しをしたい方は、下のボタンからクイズに挑戦してください!

この問題をクイズ形式で解く
問題 No.1053
高音質な音声を生成するディープラーニングモデルであるWaveNetに関する説明として、最も不適切なものを1つ選べ。

【正解の解説】

音声生成において再帰型ニューラルネットワークをベースにしており、並列計算が極めて容易である。

RNN(リカレントニューラルネットワーク)は過去の計算結果を順番に引き継ぐため並列計算が難しいですが、WaveNetは畳み込みを利用するため、実は並列計算が比較的得意な構造をしています。

スポンサーリンク

【その他の選択肢の解説】

音声の波形を1サンプルずつ逐次的に生成する自己回帰モデルである。

WaveNetは、音声の波形を一つずつ、前の音を参考にしながら順番に作り上げていく自己回帰モデルという方式を採用しています。

畳み込み層に特別な構造を採用することで受容野を広げている。

WaveNetは、畳み込み層を工夫して積むことで、離れた過去のデータも広い視野で捉えられる「受容野」を広げる構造になっています。

テキストからの音声合成だけでなく音楽の生成などにも応用されている。

WaveNetは非常に自然な音を作れるため、スマホの読み上げから音楽作成まで、幅広い音響生成の現場で使われています。