問題 No.1003
強化学習の行動価値関数をディープラーニングを用いて近似する手法を【 】と呼ぶ。
【正解の解説】
深層強化学習
深層強化学習とは、強化学習の判断基準である価値関数や方策を、ディープラーニング(深層学習)を用いて複雑な状況でも近似できるようにした手法です。
スポンサーリンク
【その他の選択肢の解説】
教師あり学習
教師あり学習とは、正解データを使ってAIに答えを教える手法であり、環境からの報酬を学習する強化学習とは異なります。
半教師あり学習
半教師あり学習とは、一部の正解データと大量のラベルなしデータを用いる手法であり、強化学習の枠組みとは別物です。
自己教師あり学習
自己教師あり学習とは、データ自身から正解を作り出してモデルに学習させる、主に事前学習で使われる手法のことです。