膨大なテキストデータから汎用的な言語モデルを事前学習する際、教師データを作るコストを抑えつつ、モデルに言語の構造を理解させるために「マスク言語モデル」という手法がとられる。この手法の目的として最も適切なものはどれか。 トップへ戻る 次へ進む スポンサーリンク