スポンサーリンク

問題番号: No.1031 (しっかりモード)

従来の囲碁AIが人間のプロ棋士の膨大な対局データを事前学習に利用していたのに対し、囲碁のルールだけを与えられ、人間の知識を一切介在させずに自己対局のみを繰り返す強化学習によって世界最強の性能に到達したモデルを【   】という。

スポンサーリンク