SOTAVerified

Multimodal Machine Translation

Multimodal machine translation is the task of doing machine translation with multiple data sources - for example, translating "a bird is flying over water" + an image of a bird over water to German text.

( Image credit: Findings of the Third Shared Task on Multimodal Machine Translation )

Papers

Showing 51–75 of 108 papers

TitleStatusHype
A Shared Task on Multimodal Machine Translation and Crosslingual Image Description—0
A Survey of Vision-Language Pre-training from the Lens of Multimodal Machine Translation—0
A Visually-Grounded Parallel Corpus with Phrase-to-Region Linking—0
CaMMT: Benchmarking Culturally Aware Multimodal Machine Translation—0
CUNI System for the WMT18 Multimodal Translation Task—0
CUNI System for WMT16 Automatic Post-Editing and Multimodal Translation Tasks—0
DCU-UvA Multimodal MT System Report—0
Debiasing Word Embeddings Improves Multimodal Machine Translation—0
Detecting Concrete Visual Tokens for Multimodal Machine Translation—0
Does Multimodality Help Human and Machine for Translation and Image Captioning?—0
Doubly-Attentive Decoder for Multi-modal Neural Machine Translation—0
Doubly Attentive Transformer Machine Translation—0
Adaptive Fusion Techniques for Multimodal Data—0
Efficient Object-Level Visual Context Modeling for Multimodal Machine Translation: Masking Irrelevant Objects Helps Grounding—0
EMMeTT: Efficient Multimodal Machine Translation Training—0
NMTPY: A Flexible Toolkit for Advanced Neural Machine Translation Systems—0
On Leveraging the Visual Modality for Neural Machine Translation—0
On Vision Features in Multimodal Machine Translation—0
OSU Multimodal Machine Translation System Report—0
Probing Representations Learned by Multimodal Recurrent and Transformer Models—0
Probing the Need for Visual Context in Multimodal Machine Translation—0
Rakuten’s Participation in WAT 2021: Examining the Effectiveness of Pre-trained Models for Multilingual and Multimodal Machine Translation—0
Sheffield MultiMT: Using Object Posterior Predictions for Multimodal Machine Translation—0
Sheffield Submissions for WMT18 Multimodal Translation Shared Task—0
SHEF-Multimodal: Grounding Machine Translation on Images—0
Show:102550
← PrevPage 3 of 5Next →

Benchmark Results

#ModelMetricClaimedVerifiedStatus
1delMeteor (EN-FR)74.6—Unverified
2ERNIE-UniX2BLEU (EN-DE)49.3—Unverified
3IKD-MMTBLEU (EN-DE)41.28—Unverified
4DCCNBLEU (EN-DE)39.7—Unverified
5CaglayanBLEU (EN-DE)39.4—Unverified
6Gumbel-Attention MMTBLEU (EN-DE)39.2—Unverified
7Multimodal TransformerBLEU (EN-DE)38.7—Unverified
8ImagiTBLEU (EN-DE)38.4—Unverified
9del+objBLEU (EN-DE)38—Unverified
10VMMTFBLEU (EN-DE)37.6—Unverified
#ModelMetricClaimedVerifiedStatus
1ViTABLEU (EN-HI)51.6—Unverified
#ModelMetricClaimedVerifiedStatus
1ViTABLEU (EN-HI)44.6—Unverified