強化学習

スポンサーリンク
AI

深層強化学習とAlphaGo|DQNから自己対戦AIまで

深層強化学習をG検定向けに解説。DQNの経験再生とターゲットネットワーク、AlphaGoとモンテカルロ木探索、産業応用の課題を整理します。
AI

強化学習の基本|報酬から学ぶAI

強化学習の基本をG検定向けに解説。エージェントと環境のループ、探索と活用のトレードオフ、マルコフ性と割引率、価値関数とQ学習・方策勾配法の違いを整理します。
スポンサーリンク