Disagreement-Regularized Imitation Learning for Image-Based Continuous Control with Gaussian and Beta Policies
arXiv:2609.38407v1 Announce Type: new Abstract: Purpose: Behavior cloning can accumulate errors when a learned controller visits states outside the demonstrated distribution. This study evaluates whether Disagreement-Regularized Imitation Learning (DRIL), which converts disagreement among cloned po…
Read the full story at arXiv cs.LG ↗
Timeline · 1 report
- 2026-10-01 04:00 · arXiv cs.LG
Disagreement-Regularized Imitation Learning for Image-Based Continuous Control with Gaussian and Beta Policies