●researcherThe findings suggest current post-training methods like DPO are insufficient for eliminating spurious context sensitivity.
●policyThis research exposes critical reliability risks when using LLMs for high-stakes professional or social assessments.