Large language models reinforce Inner Circle English norms by embedding dominant language ideologies into training data, design protocols, and evaluation benchmarks. This process marginalizes non-dominant Englishes and creates biases in how 'legitimate' language is defined.
HOW THIS AFFECTS YOU
●
researcherYou should account for sociolinguistic bias in training data and model outputs.
●
policyYou must address how evaluation benchmarks codify linguistic hegemony.