SOTAVerified

Multimodal Machine Translation

Multimodal machine translation is the task of doing machine translation with multiple data sources - for example, translating "a bird is flying over water" + an image of a bird over water to German text.

( Image credit: Findings of the Third Shared Task on Multimodal Machine Translation )

Papers

Showing 26–50 of 108 papers

TitleStatusHype
Doubly-Attentive Decoder for Multi-modal Neural Machine Translation—0
Doubly Attentive Transformer Machine Translation—0
Increasing Visual Awareness in Multimodal Neural Machine Translation from an Information Theoretic Perspective—0
Adaptive Fusion Techniques for Multimodal Data—0
Efficient Object-Level Visual Context Modeling for Multimodal Machine Translation: Masking Irrelevant Objects Helps Grounding—0
Input Combination Strategies for Multi-Source Transformer Decoder—0
Iterative Adversarial Attack on Image-guided Story Ending Generation—0
Detecting Concrete Visual Tokens for Multimodal Machine Translation—0
Generating Image Descriptions using Multilingual Data—0
Debiasing Word Embeddings Improves Multimodal Machine Translation—0
DCU-UvA Multimodal MT System Report—0
CUNI System for WMT16 Automatic Post-Editing and Multimodal Translation Tasks—0
Findings of the Second Shared Task on Multimodal Machine Translation and Multilingual Image Description—0
A Visually-Grounded Parallel Corpus with Phrase-to-Region Linking—0
Adversarial Evaluation of Multimodal Machine Translation—0
Florenz: Scaling Laws for Systematic Generalization in Vision-Language Models—0
Generalization algorithm of multimodal pre-training model based on graph-text self-supervised training—0
Hindi Visual Genome: A Dataset for Multimodal English-to-Hindi Machine Translation—0
Generative Imagination Elevates Machine Translation—0
Good for Misconceived Reasons: An Empirical Revisiting on the Need for Visual Context in Multimodal Machine Translation—0
Good for Misconceived Reasons: Revisiting Neural Multimodal Machine Translation—0
Grounded Word Sense Translation—0
Gumbel-Attention for Multi-modal Machine Translation—0
Findings of the 2018 Conference on Machine Translation (WMT18)—0
Findings of the 2017 Conference on Machine Translation (WMT17)—0
Show:102550
← PrevPage 2 of 5Next →

Benchmark Results

#ModelMetricClaimedVerifiedStatus
1delMeteor (EN-FR)74.6—Unverified
2ERNIE-UniX2BLEU (EN-DE)49.3—Unverified
3IKD-MMTBLEU (EN-DE)41.28—Unverified
4DCCNBLEU (EN-DE)39.7—Unverified
5CaglayanBLEU (EN-DE)39.4—Unverified
6Gumbel-Attention MMTBLEU (EN-DE)39.2—Unverified
7Multimodal TransformerBLEU (EN-DE)38.7—Unverified
8ImagiTBLEU (EN-DE)38.4—Unverified
9del+objBLEU (EN-DE)38—Unverified
10VMMTFBLEU (EN-DE)37.6—Unverified
#ModelMetricClaimedVerifiedStatus
1ViTABLEU (EN-HI)51.6—Unverified
#ModelMetricClaimedVerifiedStatus
1ViTABLEU (EN-HI)44.6—Unverified