Category:強化学習

階層型強化学習

DQN (コンピュータ)

モデルフリー (強化学習)
Model-free (reinforcement learning)
分布ソフト・アクター・クリティック法
Distributional Soft Actor Critic
ベイズ強化学習

エンドツーエンドの強化学習
End-to-end reinforcement learning
SARSA法
State–action–reward–state–action
近接方策最適化
Proximal policy optimization
時間差分学習
Temporal difference learning
人間のフィードバックによる強化学習
Reinforcement learning from human feedback
Q学習
Q-learning
強化学習
Reinforcement learning