問題 No.1247
強化学習を用いた囲碁AIの発展において、人間の棋譜データを初期学習に一切使用せず、ゲームの基本ルールのみを与えられた状態から完全な自己対局を繰り返すことで、従来のモデルを超える圧倒的な強さを獲得したシステムはどれか。
【正解の解説】
AlphaGo Zero
AlphaGo Zeroは、人間の棋譜データを使わず、ルールだけを教えられて完全自己対局のみで学習し、AlphaGoを圧倒した画期的なシステムです。
スポンサーリンク
【その他の選択肢の解説】
AlphaGo
AlphaGoは、人間の棋譜データを大量に学習した上で強化学習を組み合わせた囲碁AIです。
Alpha Zero
AlphaZeroは、AlphaGo Zeroの手法を拡張し、囲碁だけでなく将棋やチェスにも対応できるようにした汎用的なシステムです。
AlphaStar
AlphaStarは、スタークラフト2というリアルタイム戦略ゲームをプレイするために開発された強化学習AIです。