見出し画像

Gymで強化学習⑰SARSA：実装編

澁谷直樹 @ キカベン

2023年4月30日 22:27

前回はTD学習法の理論について解説しました。今回は、オンポリシーでTD学習法を行うSARSAについて解説し実装します。

まずは、SARSAをオンポリシーのTD学習法として導入してから実装を解説します。

ここから先は

14,879字 / 1画像

キカベン・読み放題

¥1,000 / 月

アルゴリズム、機械学習、深層学習、強化学習、量子技術をわかりやすく

すべての記事とマガジンが読み放題
メンバー限定の会員証が発行されます
活動期間に応じたバッジを表示
メンバー限定掲示板を閲覧できます
メンバー特典記事を閲覧できます
メンバー特典マガジンを閲覧できます

このメンバーシップの詳細

この記事が気に入ったらチップで応援してみませんか？