音声認識システムにおいて、入力される音声の波形フレーム数と、出力されるテキストの文字数は一致しない。そのため、どのタイミングの音声がどの文字に対応するかを事前にラベル付けすることは困難である。このように入出力の長さが異なる系列データ同士のマッピングを、空白を表す特殊なラベルを用いて自動で整列させ、一気通貫で学習させる仕組みはどれか。 トップへ戻る 次へ進む スポンサーリンク