CRA-Net: Detecting Conversational Risk Accumulation in Multi-Turn LLMs
July 23, 2026
Identifies safety failures caused by gradual intent drift and instruction assembly over multi-turn dialogues rather than single prompts. The framework uses a session-layer approach tracking semantic drift and sensitivity-weighted information accumulation, supported by the CRA-Bench v0.1 dataset.
HOW THIS AFFECTS YOU
●
builderYou can implement session-layer guardrails to prevent users from bypasssing safety via incremental prompt manipulation.
●
policyYou can better evaluate how long-running conversational agents accumulate risk over time.