Independent projects — infrastructure, robotics, technology surveys, and corporate research
Tag · 1 entries

#DAgger

September 3, 2026 Reinforcement Learning Primer

Reinforcement Learning Primer: Imitation Learning and Inverse Reinforcement Learning

Behavior Cloning, DAgger, and inverse reinforcement learning use demonstrations when rewards are hard to write. This primer covers covariate shift, reward inference, VLA connections, evaluation, safety, and data provenance.