スポンサーリンク
問題番号: No.435 (しっかりモード)
Q学習にディープラーニングを組み合わせ、エージェントが画面の画素データから直接、最適な行動(行動価値関数)を推定して学習する強化学習手法はどれか。
トップへ戻る
次へ進む
スポンサーリンク
この問題の間違いを報告する
問題の誤りを報告
問題番号
について、間違いの内容をご記入ください。
間違いの内容
キャンセル
送信する