スポンサーリンク

問題の解答・解説ページ

このページは解説の閲覧モードです。
実力試しをしたい方は、下のボタンからクイズに挑戦してください!

この問題をクイズ形式で解く
問題 No.1003
強化学習の行動価値関数をディープラーニングを用いて近似する手法を【 】と呼ぶ。

【正解の解説】

深層強化学習

深層強化学習とは、強化学習の判断基準である価値関数や方策を、ディープラーニング(深層学習)を用いて複雑な状況でも近似できるようにした手法です。

スポンサーリンク

【その他の選択肢の解説】

教師あり学習

教師あり学習とは、正解データを使ってAIに答えを教える手法であり、環境からの報酬を学習する強化学習とは異なります。

半教師あり学習

半教師あり学習とは、一部の正解データと大量のラベルなしデータを用いる手法であり、強化学習の枠組みとは別物です。

自己教師あり学習

自己教師あり学習とは、データ自身から正解を作り出してモデルに学習させる、主に事前学習で使われる手法のことです。