スポンサーリンク

問題番号: No.773 (しっかりモード)

音声認識タスクにおいて、入力される音声波形のフレーム数と出力される文字数は一致しないため、どの音声部分がどの文字に対応するかを事前に厳密に紐付けることが難しい。この課題を解決するため、同じ文字の連続や空白記号の出力確率を考慮し、すべての可能な文字の並びのパターンを周辺化してモデルを直接エンドツーエンドで学習できるようにした損失関数はどれか。

スポンサーリンク