Reinforcement Learning Crash Course by Viviane Clay
0:00:20 MDP Definition
0:03:17 MDP Example
0:07:40 Markov Property
0:08:30 Our Goal + Discounted Return
0:12:30 State Values
0:13:30 Optimal Policy
0:14:50 Example
0:17:50 Exercise
0:18:55 Exercise Solution