問題 No.489
ゲーム木の探索において、現在のノードで既に得られた評価値よりも悪い結果しか得られないと判断できる枝を、探索打ち切り対象とする手法はどれか。
【正解の解説】
βカット
βカットは、αβ法の中で、探索を打ち切るための条件の一つとして現れる処理を指します。
スポンサーリンク
【その他の選択肢の解説】
αβ法
αβ法は、ゲーム木探索において、すでに得られた良い結果よりも明らかに悪いと判断できる枝を探索しないことで、効率的に最善手を見つけるための手法です。
ε-greedy方策
ε-greedy方策は、強化学習において、ある確率(ε)でランダムな行動をとり、それ以外では現在の最善の行動をとることで、未知の探索と知識の活用を両立させる手法です。
Actor-Critic
Actor-Criticは、行動を選択する「Actor」と、その行動を評価する「Critic」という2つのモデルを組み合わせて学習を行う強化学習手法です。