見出し画像

GPT-1を読む④事前１

2024年5月23日 13:33

前回は、OpenAIが2018年に発表したGPTの最初のバージョンの論文「Improving Language Understanding by Generative Pre-Training」を読む方針を決めました。

まずは、「３ Framework」（セクション３「フレームワーク」）を重点的に読むことにしました。これによって、GPT-1における「教師なしの事前学習」と「ファインチューニング」などの理解を深めるのが目的です。

今回からの数記事で、このセクションの全体を読み、最終的には、この論文において代表的な以下の図を理解することを目指します。

論文図１

今記事では、セクション３「フレームワーク」から読み始めます。最初のサブセクションであるセクション３.１「教師なしの事前学習」で登場する目的関数を中心に解説します。

ここから先は

7,760字

キカベン・読み放題

¥1,000 / 月

初月無料

アルゴリズム、機械学習、深層学習、強化学習、量子技術をわかりやすく

すべての記事とマガジンが読み放題
メンバー限定の会員証が発行されます
活動期間に応じたバッジを表示
メンバー限定掲示板を閲覧できます
メンバー特典記事を閲覧できます
メンバー特典マガジンを閲覧できます

このメンバーシップの詳細

この記事が気に入ったらサポートをしてみませんか？