大規模言語モデル(LLM)の基本
Vidhi Chugh
AI strategist and ethicist

生成的事前学習を使って訓練する

入力
素早い茶色い
素早い茶色いキツネ
素早い茶色いキツネが
素早い茶色いキツネが怠惰な
素早い茶色いキツネが怠惰な犬
素早い茶色いキツネが怠惰な犬を
素早い茶色いキツネが怠惰な犬を飛び越える。
出力
キツネ
が
怠惰な
犬
を
飛び越える。

特定の単語を隠す
学習済みモデルが隠された(マスクされた)単語を予測
元のテキスト: 素早い茶色いキツネが、怠惰な犬を飛び越える
マスクされたテキスト: 素早い[マスク]キツネが、怠惰な犬を飛び越える
目的:マスクされた単語を予測する
これまでの訓練データをもとに予測する
大規模言語モデル(LLM)の基本