エッジデバイス向けにモデルを軽量化する際、予測性能が高い巨大な教師モデルが出力する確率分布を手本として、構造が小さい生徒モデルに学習させ、精度低下を抑えながらモデルを圧縮する手法はどれか。 トップへ戻る 次へ進む スポンサーリンク