Bootstrapping strategies for lexicon design significantly improve forced alignment for code-mixed Hindi-English speech. Acoustic models trained on sentence-level code-mixed data achieved a 4.15ms mean error, outperforming monolingual alternatives by nearly 10x.
HOW THIS AFFECTS YOU
●
researcherThis demonstrates that code-mixed training data is critical for low-latency bilingual speech alignment.