ディープラーニングの学習において、各層への入力分布が学習の進行に伴って変化してしまう内部共変量シフトという問題がある。これを防ぐために導入された技術であり、ミニバッチごとに各層の出力を平均0、分散1となるように標準化し、その後学習可能なパラメータを用いてスケーリングとシフトを行う層を何と呼ぶか。 トップへ戻る 次へ進む スポンサーリンク