IndicSafeEval Benchmarks Multilingual Jailbreak Vulnerabilities in Indian Languages
September 4, 2026
IndicSafeEval introduces a 7,200-prompt benchmark testing safety robustness against persuasive jailbreaks across four Indian languages. Results show that LLM safety performance varies significantly depending on the specific language and persuasion strategy used.
HOW THIS AFFECTS YOU
●
builderYou cannot rely on English-centric safety evaluations when deploying models in multilingual markets like India.
●
policyThis highlights critical gaps in safety alignment for non-English linguistic contexts.