A new episodic, derivative-free latent policy improvement approach boosts pretrained diffusion or flow matching robot policies by adjusting initial noise sampling, working across MLP and VLA models…
#RobotLearning #DiffusionModels #PolicyImprovement #GenerativeAI
https://arxiv.org/abs/2603.15757
