ML Reviewer Scores Lack Cross-Domain Comparability
July 31, 2026
Analysis of 50,289 papers across 219 research topics shows that fixed numerical scales in ML peer review fail to provide uniform quality measurements across different research communities. Findings suggest area chairs must rely on community priors rather than absolute scores due to structural differences in reviewer pools.
HOW THIS AFFECTS YOU
●
researcherYou should account for community-specific scoring norms when evaluating paper quality.