The SaliTrap Benchmark demonstrates that mainstream LLMs suffer from salience bias, where models prioritize explicit input distractors over implicit commonsense requirements. Testing 12 state-of-the-art models shows that performance degrades as distractor density increases.
HOW THIS AFFECTS YOU
●
researcherThis highlights a fundamental vulnerability in how LLMs process task framing versus commonsense knowledge.