スポンサーリンク

問題の解答・解説ページ

このページは解説の閲覧モードです。
実力試しをしたい方は、下のボタンからクイズに挑戦してください!

この問題をクイズ形式で解く
問題 No.1012
アンサンブル学習の手法であるランダムフォレストが、単一の決定木モデルと比較して高い汎化性能を持ち、過学習を起こしにくい理由に関する記述のうち、【不適切なもの】はどれか。

【正解の解説】

すべての決定木が完全に同じ構造になるように強力な制約をかけ、最も表現力の高い1つのツリーの出力を最優先する仕組みを持っているため。

すべての決定木が全く同じだと、どれか1つが間違えれば全部同じ間違いをすることになります。そのため、あえて少しずつ異なる木を作ることで全体の予測性能を上げるのがランダムフォレストの強みであり、同じにするという記述は不適切です。

スポンサーリンク

【その他の選択肢の解説】

元のデータセットから重複を許してランダムにサンプルを抽出して異なるデータで複数の木を学習させるため。

元のデータの一部を重複を許してランダムに取り出し、それを使って複数の木を学習させる手法(バギング)により、それぞれの木が異なる視点を持つようになり、全体の予測が安定します。

各決定木のノードを分割する際、すべての特徴量を使うのではなく、ランダムに選択された一部の特徴量のみを候補として使用するため。

決定木のノードを分割する際、限られた特徴量だけを使うことで、木同士の多様性が生まれ、特定のデータに極端に依存しすぎることを防ぎます。

構築された大量の決定木の予測結果を組み合わせる際、多数決や平均を取ることで、個々の木のばらつきを相殺できるため。

たくさんの木による予測を多数決や平均で統合することで、個々の木が抱えるちょっとした間違いや偏りを打ち消し合い、モデル全体の精度を高めます。