T2M Refinement for Diffusion Language Model Consistency
August 21, 2026
Token-to-Mask (T2M) is a training-free inference-time method that improves diffusion language models by remasking low-confidence tokens during the denoising process. This correction mechanism transfers across tasks and models without requiring retuning.
HOW THIS AFFECTS YOU
●
builderYou can improve the consistency of diffusion-based text generation without the cost of retraining.
●
researcherThis approach offers a way to mitigate intra-step inconsistencies in iterative denoising models.