テキストから人間の声に近い自然な音声を生成する音声合成タスクにおいて従来の隠れマルコフモデルを用いた手法では不自然な機械音になりがちであった。音声波形のサンプリング値を1つずつ自己回帰的に予測する際過去の広い範囲のデータを効率よく参照するために拡張畳み込みを採用し極めて高品質な音声生成を実現したモデルはどれか。 トップへ戻る 次へ進む スポンサーリンク