Reinforcement Learning Primer
Reinforcement Learning Primer: Imitation Learning and Inverse Reinforcement Learning
Behavior Cloning, DAgger, and inverse reinforcement learning use demonstrations when rewards are hard to write. This primer covers covariate shift, reward inference, VLA connections, evaluation, safety, and data provenance.