スポンサーリンク

問題番号: No.72 (しっかりモード)

自動運転システムやモバイル端末など、計算資源(メモリや電力)が極めて限定された環境にディープラーニングモデルを組み込みたい。ネットワークの構造(レイヤー数やノイズ)を削るのではなく、通常は「32ビット浮動小数点数(FP32)」で表現されているパラメータの数値を、「8ビット整数(INT8)」などの低い精度に落とすことで、メモリ容量を大幅に削減し計算を高速化する手法はどれか。

スポンサーリンク