●builderYou should consider using specialized moderation models rather than relying solely on frontier LLMs for specific safety risks.
●policyThis demonstrates why generalized safety benchmarks may fail to capture nuanced adversarial or implicit harms.