見出し画像

Gymで強化学習㊴REINFORCE：実践編①

澁谷直樹 @ キカベン

2023年9月23日 23:52

前回は、REINFORCEの理論的な側面を解説しました。今回は、REINFORCEの実装をし、Gym環境であるCartPoleを使って実験します。

また、単純なベースラインを導入して、ベースラインがある無しで訓練の安定性やテスト結果にどのような差が出るかを確認します。

では、さっそく始めましょう。

ここから先は

20,380字 / 2画像

キカベン・読み放題

¥1,000 / 月

初月無料

アルゴリズム、機械学習、深層学習、強化学習、量子技術をわかりやすく

すべての記事とマガジンが読み放題
メンバー限定の会員証が発行されます
活動期間に応じたバッジを表示
メンバー限定掲示板を閲覧できます
メンバー特典記事を閲覧できます
メンバー特典マガジンを閲覧できます

このメンバーシップの詳細

この記事が気に入ったらチップで応援してみませんか？