New work proposes constrained command-conditioned PPO for MicroRTS, letting RL strategies adapt to varied opponents via discrete high-level commands and a shared executor. Worth a look for those training brittle RTS agents.
#reinforcementlearning #rts #microRTS
https://arxiv.org/abs/2610.11663
