arXiv paper proposes a closed-loop framework that iteratively refines imitation-learning policies via LLM analysis of rollout data, reporting up to 15% gains on car racing and door opening.
#ImitationLearning #LLMAgents #PolicyRefinement #Robotics
https://arxiv.org/abs/2610.01652
