Narrow finetunes of AI models contradict themselves when resampled on a new 175-question benchmark, revealing issues like identity conflation and introspection failures beyond mere ambiguity.
#AIsafety #ModelEvaluation #LLMResearch #Finetuning
https://arxiv.org/abs/2610.12129
