행동 복제, DAgger 및 역강화 학습은 보상을 설정하기 어려울 때 시연을 활용합니다. 이 입문 과정에서는 공변량 변화, 보상 추론, VLA 연결, 평가, 안전성 및 데이터 출처에 대해 다룹니다.