スポンサーリンク

問題番号: No.716 (しっかりモード)

従来のRNNのように時系列順にデータを処理するのではなく、文章内の全ての単語同士の関連度を一斉に計算する「セルフアテンション」という仕組みを採用し、並列処理を可能にして現在のLLMの基盤となったモデルアーキテクチャはどれか。

スポンサーリンク