Cross-Script Safety Inconsistency in Urdu LLM Moderation
August 26, 2026
An evaluation of GPT-4o, Claude Sonnet 4.5, Gemini 2.5 Flash, Qwen-2.5, and Llama-3.1 reveals significant safety failures in Urdu. The 'Missed-in-Urdu' rate, where harmful content in original scripts passes English translation checks, reached a median of 4.3%.
HOW THIS AFFECTS YOU
●
builderYou cannot rely on English-centric safety layers for effective content moderation in Urdu-speaking markets.
●
policyThis highlights a critical gap in global safety benchmarks for non-Latin scripts.