Courses

Fall 2022

Reinforcement Learning

, 3 pts, E4529

Reinforcement Learning

Markov Decision Processes (MDP) and Reinforcement Learning (RL) problems. Reinforcement Learning algorithms including Q-learning, policy gradient methods, actor-critic method. Reinforcement learning while doing exploration-exploitation dilemma, multi-armed bandit problem. Monte Carlo Tree Search methods, Distributional, Multi-agent, and Causal Reinforcement Learning. 

Section Number
001
Call Number
13178
Day, Time & Location
F 1:10PM-3:40PM 517 Hamilton Hall
Instructor
Shipra Agrawal