MIRROR Optimizes VLM Reasoning via Modality-Informed Reciprocal Optimization
July 24, 2026
MIRROR addresses reasoning inconsistencies in vision-language models by leveraging ODA-Data, a paired dataset containing text-dominant, image-dominant, and combined views of geometry problems. The method optimizes models to exploit complementary reasoning paths across different modalities to improve multimodal performance.
HOW THIS AFFECTS YOU
●
builderYou can improve VLM reasoning consistency by incorporating multi-view training objectives.
●
researcherYou can use the ODA-Data dataset to study modality-dependent failure modes in VLMs.