LLM-based AutoResearch systems often improve one behavior at another's expense, since scalar feedback hides those trade-offs. The paper finds that adding competing-behavior feedback when task gains slow down boosts…
#AutoResearch #MachineLearning #AIresearch
https://arxiv.org/abs/2609.39933
