Spring 2023
Reinforcement Learning
, 3 pts, E4529Reinforcement Learning
Markov Decision Processes (MDP) and Reinforcement Learning (RL) problems. Reinforcement Learning algorithms including Q-learning, policy gradient methods, actor-critic method. Reinforcement learning while doing exploration-exploitation dilemma, multi-armed bandit problem. Monte Carlo Tree Search methods, Distributional, Multi-agent, and Causal Reinforcement Learning.
- Section Number
- 001
- Call Number
- 15218
- Day, Time & Location
- TR 5:40PM-6:55PM 524 Seeley W. Mudd Building
- Instructor
- Farid Alizadeh