問題 No.730
機械学習の分類タスクにおいて、各特徴量の重要度や判断の分岐条件を人間が容易に視覚的に解釈したい。情報利得やジニ不純度を基準にしてデータを分割していくアルゴリズムはどれか。
【正解の解説】
決定木
決定木は、あるルールに基づきデータを枝分かれさせて分類するアルゴリズムです。結果がフローチャートのように視覚化されるため、なぜその判定に至ったか人間が説明しやすいという特徴があります。
スポンサーリンク
【その他の選択肢の解説】
サポートベクターマシン
サポートベクターマシンは、境界線を引くことでデータをクラス分けする手法です。計算能力は高いですが、人間が内部の計算過程を目視で理解するのは困難です。
k-means法
k-means法は、似たもの同士をいくつかのグループ(クラスタ)に分ける教師なし学習の手法です。分類の基準が明確な分類タスクではなく、データの集合を分けるために使われます。
ロジスティック回帰
ロジスティック回帰は、あるデータが特定のクラスに属する「確率」を予測する手法です。数式ベースであるため、解釈は可能ですが、決定木のようにツリー構造にはなりません。