RAGSieve Detects Knowledge Poisoning in RAG Systems with 95.2% AUROC
August 14, 2026
RAGSieve identifies injected malicious documents in RAG pipelines using self-referenced local contrast. It employs query-local scoring of top-5 candidates against ranks 6-20 to detect answer-anchor concentration, outperforming GMTP in detection rates.
HOW THIS AFFECTS YOU
●
builderYou can implement this to defend your RAG pipelines against document injection attacks.
●
policyThis improves the safety and reliability of retrieval-augmented systems against coordinated data poisoning.