Llama 3.1 8B RAG Accuracy Drops to 43.5% Under Document Poisoning
September 10, 2026
Retrieving poisoned context via entity, number, or negation swaps significantly degrades Llama 3.1 8B performance on FEVER fact-checking tasks. Accuracy falls from 77.9% to 43.5% when all three retrieved passages are corrupted, with entity swaps causing the most frequent answer flips.
HOW THIS AFFECTS YOU
●
builderYou must implement robust verification steps to prevent poisoned retrieval context from inducing model hallucinations.
●
policyThis highlights critical security vulnerabilities in RAG pipelines that require standardized safety protocols.