Courses

Spring 2023

Reinforcement Learning

, 3 pts, E4529

Reinforcement Learning

Markov Decision Processes (MDP) and Reinforcement Learning (RL) problems. Reinforcement Learning algorithms including Q-learning, policy gradient methods, actor-critic method. Reinforcement learning while doing exploration-exploitation dilemma, multi-armed bandit problem. Monte Carlo Tree Search methods, Distributional, Multi-agent, and Causal Reinforcement Learning. 

Section Number
001
Call Number
15218
Day, Time & Location
TR 5:40PM-6:55PM 524 Seeley W. Mudd Building
Instructor
Farid Alizadeh