Improving Cross-Lingual Sequential Sentence Classification via Structural Similarity
September 18, 2026
Researchers introduce a multilingual dataset covering 13 non-English languages to improve sequential sentence classification in scientific papers. The method leverages discourse-level patterns, such as label sequences and positional regularities, to enhance transfer success across languages with limited training data.
HOW THIS AFFECTS YOU
●
researcherYou can use this dataset to evaluate cross-lingual discourse modeling in academic document parsing.