Bayesian Data Mixing Improves AI-Text Detection Out-of-Distribution Performance
July 21, 2026
Fine-tuned BERT-tiny models with Bayesian classification heads can optimize data mixing to prevent shortcut learning in AI detectors. This method produced a DeBERTa-V3-large classifier achieving a 0.882 mean score across five metrics, including AUROC and Brier score, on the PAN 2026 test set.
HOW THIS AFFECTS YOU
●
researcherYou can use Bayesian heads to select optimal training subsets that improve OOD robustness in text classifiers.