Adversarial prompt-injection attacks can flip safety-aligned LLMs from slow polynomial to exponential scaling in attack success with more inference-time samples, per a new arXiv study. The authors back the empirical finding…
#LLMSecurity #AIAlignment #Jailbreak
https://arxiv.org/abs/2603.11331
