SOTAVerified

Cross-Lingual Bitext Mining

Cross-lingual bitext mining is the task of mining sentence pairs that are translations of each other from large text corpora.

Papers

Showing 1–6 of 6 papers

TitleStatusHype
Improving Neural Machine Translation Models with Monolingual DataCode1
Massively Multilingual Sentence Embeddings for Zero-Shot Cross-Lingual Transfer and BeyondCode1
Parallel Sentence Mining by Constrained DecodingCode1
Majority Voting with Bidirectional Pre-translation For Bitext RetrievalCode0
Margin-based Parallel Corpus Mining with Multilingual Sentence EmbeddingsCode0
Low-Resource Machine Translation Training Curriculum Fit for Low-Resource Languages—0
Show:102550

Benchmark Results

#ModelMetricClaimedVerifiedStatus
1Massively Multilingual Sentence EmbeddingsF1 score93.91—Unverified
2Multilingual Sentence EmbeddingsF1 score92.89—Unverified
3Monolingual training dataF1 score75.8—Unverified
#ModelMetricClaimedVerifiedStatus
1Massively Multilingual Sentence EmbeddingsF1 score96.19—Unverified
2Multilingual Sentence EmbeddingsF1 score95.58—Unverified
3Monolingual training dataF1 score76.9—Unverified
#ModelMetricClaimedVerifiedStatus
1Massively Multilingual Sentence EmbeddingsF1 score92.27—Unverified
#ModelMetricClaimedVerifiedStatus
1Massively Multilingual Sentence EmbeddingsF1 score93.3—Unverified