Correct-Token Retention Regularization for Uniform-State Diffusion Models
October 2, 2026
Uniform-state diffusion models currently struggle with token retention, frequently revising 173–270 of 512 positions even during greedy-tail decoding. The authors identify a validation NELBO decomposition deficit where training fails to penalize incorrect predictions at clean positions, proposing a new regularization method to stabilize sampling diversity.
HOW THIS AFFECTS YOU
●
researcherYou can use this regularization to improve sampling stability in diffusion-based language models.