スポンサーリンク

問題の解答・解説ページ

このページは解説の閲覧モードです。
実力試しをしたい方は、下のボタンからクイズに挑戦してください!

この問題をクイズ形式で解く
問題 No.1247
強化学習を用いた囲碁AIの発展において、人間の棋譜データを初期学習に一切使用せず、ゲームの基本ルールのみを与えられた状態から完全な自己対局を繰り返すことで、従来のモデルを超える圧倒的な強さを獲得したシステムはどれか。

【正解の解説】

AlphaGo Zero

AlphaGo Zeroは、人間の棋譜データを使わず、ルールだけを教えられて完全自己対局のみで学習し、AlphaGoを圧倒した画期的なシステムです。

スポンサーリンク

【その他の選択肢の解説】

AlphaGo

AlphaGoは、人間の棋譜データを大量に学習した上で強化学習を組み合わせた囲碁AIです。

Alpha Zero

AlphaZeroは、AlphaGo Zeroの手法を拡張し、囲碁だけでなく将棋やチェスにも対応できるようにした汎用的なシステムです。

AlphaStar

AlphaStarは、スタークラフト2というリアルタイム戦略ゲームをプレイするために開発された強化学習AIです。