SOTAVerified

Cross-Lingual Document Classification

Cross-lingual document classification refers to the task of using data and models available for one language for which ample such resources are available (e.g., English) to solve classification tasks in another, commonly low-resource, language.

Papers

No papers found.

Benchmark Results

#ModelMetricClaimedVerifiedStatus
1XLMft UDAAccuracy96.05—Unverified
2MultiFiT, pseudoAccuracy89.42—Unverified
3Massively Multilingual Sentence EmbeddingsAccuracy77.95—Unverified
4BiLSTM (UN)Accuracy74.52—Unverified
5BiLSTM (Europarl)Accuracy72.83—Unverified
6MultiCCA + CNNAccuracy72.38—Unverified
#ModelMetricClaimedVerifiedStatus
1XLMft UDAAccuracy96.8—Unverified
2MultiFiT, pseudoAccuracy79.1—Unverified
3Massively Multilingual Sentence EmbeddingsAccuracy77.33—Unverified
4MultiCCA + CNNAccuracy72.5—Unverified
5BiLSTM (UN)Accuracy69.5—Unverified
6BiLSTM (Europarl)Accuracy66.65—Unverified
#ModelMetricClaimedVerifiedStatus
1XLMft UDAAccuracy93.32—Unverified
2MultiFiT, pseudoAccuracy82.48—Unverified
3MultiCCA + CNNAccuracy74.73—Unverified
4BiLSTM (UN)Accuracy71.97—Unverified
5Massively Multilingual Sentence EmbeddingsAccuracy71.93—Unverified
#ModelMetricClaimedVerifiedStatus
1XLMft UDAAccuracy96.95—Unverified
2MultiFiT, pseudoAccuracy91.62—Unverified
3Massively Multilingual Sentence EmbeddingsAccuracy84.78—Unverified
4MultiCCA + CNNAccuracy81.2—Unverified
5BiLSTM (Europarl)Accuracy71.83—Unverified
#ModelMetricClaimedVerifiedStatus
1XLMft UDAAccuracy89.7—Unverified
2MultiFiT, pseudoAccuracy67.83—Unverified
3Massively Multilingual Sentence EmbeddingsAccuracy67.78—Unverified
4BiLSTM (UN)Accuracy61.42—Unverified
5MultiCCA + CNNAccuracy60.8—Unverified
#ModelMetricClaimedVerifiedStatus
1MultiFiT, pseudoAccuracy76.02—Unverified
2Massively Multilingual Sentence EmbeddingsAccuracy69.43—Unverified
3MultiCCA + CNNAccuracy69.38—Unverified
4BiLSTM (Europarl)Accuracy60.73—Unverified
#ModelMetricClaimedVerifiedStatus
1MultiFiT, pseudoAccuracy69.57—Unverified
2MultiCCA + CNNAccuracy67.63—Unverified
3Massively Multilingual Sentence EmbeddingsAccuracy60.3—Unverified
#ModelMetricClaimedVerifiedStatus
1Biinclusion (Euro500kReuters)Accuracy92.7—Unverified
2Bi+Accuracy88.1—Unverified
3biCVM+Accuracy86.2—Unverified
#ModelMetricClaimedVerifiedStatus
1Biinclusion (Euro500kReuters)Accuracy84.4—Unverified
2Bi+Accuracy79.2—Unverified
3biCVM+Accuracy76.9—Unverified
#ModelMetricClaimedVerifiedStatus
1BiLSTM (Europarl)Accuracy75.45—Unverified