Scale-Aware Memorization Diagnostics for Code LLMs
August 14, 2026
Current memorization probing techniques, such as synonym fuzzing and log-probability analysis, fail to accurately detect memorization in large-scale decoder architectures. The study demonstrates that larger models decouple representation load from memorization, necessitating new diagnostic methods like invertible mathematical transforms.
HOW THIS AFFECTS YOU
●
researcherYou should reconsider your memorization evaluation metrics when testing models at scale, as traditional probes break down.