問題 No.716
従来のRNNのように時系列順にデータを処理するのではなく、文章内の全ての単語同士の関連度を一斉に計算する「セルフアテンション」という仕組みを採用し、並列処理を可能にして現在のLLMの基盤となったモデルアーキテクチャはどれか。
【正解の解説】
Transformer
Transformerとは、文章中の単語同士のつながりを一斉に計算するセルフアテンションを採用し、従来のRNNとは異なり計算を並列化できるため、現在のLLMの基盤となったモデルです。
スポンサーリンク
【その他の選択肢の解説】
CNN
CNN(畳み込みニューラルネットワーク)とは、主に画像の中にある模様や特徴を段階的に抽出するのに適した、画像認識で広く使われるモデル構造です。
GAN
GAN(敵対的生成ネットワーク)とは、本物そっくりのデータを作る生成器と、真偽を見抜く識別器が互いに競い合いながら精度を高めていくモデルです。
強化学習
強化学習とは、AIが環境の中で試行錯誤を繰り返し、与えられた報酬を最大化するような行動を学習していく仕組みのことです。