LZ Penalty Enables Greedy Decoding Without Degenerate Repetition
August 19, 2026
The LZ penalty uses LZ77-based information-theoretic principles to reduce repetitions in autoregressive models. This method allows state-of-the-art open-source reasoning models to use temperature-zero greedy decoding without the 4% repetition rates typical of standard frequency penalties.
HOW THIS AFFECTS YOU
●
builderYou can use greedy decoding for more deterministic reasoning outputs without risking repetitive loops.
●
researcherThe prediction-compression duality offers a new way to regularize decoding via residual distributions.